Welche KI läuft auf dem Mac mit M3 (24 GB)?

Macs mit Apple M3 und 24 GB gemeinsamem Arbeitsspeicher (MacBook, Mac mini, iMac oder Mac Studio) stellen ca. 16,1 GB für KI-Modelle bereit. Damit laufen 4 von 22 aktuellen Modellen flüssig.

Kurzfazit

Ein Mac mit M3 (24 GB) ist gut für lokale KI geeignet – auch die deutlich klügeren 12B- bis 21B-Modelle laufen flüssig.

Im Rechner mit eigenen Einstellungen prüfen

Alle Modelle auf dem M3 mit 24 GB

Annahmen: 8.000 Tokens Kontext, Standard-Quantisierung Q4 (wie bei Ollama), Speicherfreigabe von macOS ohne manuelle Anpassung.

ModellErgebnisSpeicherTempoDetails
gpt-oss 20B
Chat · Logik · Programmieren
Läuft flüssig11,7 GBca. 31 Tokens/sMXFP4 (Original)
Gemma 3 4B
Chat · Bilder
Läuft flüssig4,2 GBca. 23 Tokens/sQ4 (Standard)
Qwen3 4B
Chat · Logik
Läuft flüssig4,1 GBca. 25 Tokens/sQ4 (Standard)
Llama 3.2 3B
Chat
Läuft flüssig3,3 GBca. 31 Tokens/sQ4 (Standard)
Qwen3 30B-A3B
Chat · Logik
Läuft, etwas langsamer15,6 GBca. 37 Tokens/sQ3 (spürbare Einbußen)
Qwen3-Coder 30B-A3B
Programmieren
Läuft, etwas langsamer15,6 GBca. 37 Tokens/sQ3 (spürbare Einbußen)
Qwen3 14B
Chat · Logik · Programmieren
Läuft, etwas langsamer10,5 GBca. 7 Tokens/sQ4 (Standard)
Phi-4 14B
Chat · Logik
Läuft, etwas langsamer10,7 GBca. 7 Tokens/sQ4 (Standard)
Gemma 3 12B
Chat · Bilder
Läuft, etwas langsamer10,7 GBca. 8 Tokens/sQ4 (Standard)
Mistral Nemo 12B
Chat
Läuft, etwas langsamer8,9 GBca. 8 Tokens/sQ4 (Standard)
Qwen3 8B
Chat · Logik · Programmieren
Läuft, etwas langsamer6,5 GBca. 12 Tokens/sQ4 (Standard)
Llama 3.1 8B
Chat
Läuft, etwas langsamer6,3 GBca. 12 Tokens/sQ4 (Standard)
Mistral Small 3.1 24B
Chat · Bilder
Nur sehr langsam15,8 GBca. 4 Tokens/sQ4 (Standard)
Gemma 3 27B
Chat · Bilder
Passt nicht––braucht ca. 17,3 GB
Qwen3 32B
Chat · Logik · Programmieren
Passt nicht––braucht ca. 17,9 GB
Qwen2.5-Coder 32B
Programmieren
Passt nicht––braucht ca. 17,9 GB
DeepSeek-R1 32B (Distill)
Logik
Passt nicht––braucht ca. 17,9 GB
Llama 3.3 70B
Chat
Passt nicht––braucht ca. 36,1 GB
Llama 4 Scout
Chat · Bilder
Passt nicht––braucht ca. 53,1 GB
gpt-oss 120B
Chat · Logik · Programmieren
Passt nicht––braucht ca. 60,8 GB
Qwen3 235B-A22B
Chat · Logik · Programmieren
Passt nicht––braucht ca. 112,0 GB
DeepSeek-R1 671B
Logik
Passt nicht––braucht ca. 314,9 GB

Mehr KI mit mehr Speicher

Mini-PC mit Ryzen AI Max+ 395 (128 GB)

Riesige Modelle zum Mini-PC-Preis.

+9 Modelle flüssig, z. B. gpt-oss 120B

Preise bei Amazon ansehen*

* Werbelink: Wenn du über diesen Link kaufst, erhalten wir eine kleine Provision. Für dich ändert sich am Preis nichts.

Häufige Fragen

Reicht ein Mac mit M3 (24 GB) für lokale KI?

Ein Mac mit M3 (24 GB) ist gut für lokale KI geeignet – auch die deutlich klügeren 12B- bis 21B-Modelle laufen flüssig. Von 24 GB Arbeitsspeicher kann macOS standardmäßig ca. 16,1 GB für die KI bereitstellen. Damit laufen 4 von 22 Modellen flüssig.

Welches KI-Modell ist das beste für den M3 mit 24 GB?

Unsere Empfehlung ist gpt-oss 20B: Offenes Modell von OpenAI, sehr schnell dank MoE. Starten lässt es sich mit „ollama run gpt-oss:20b“.

Läuft Qwen3 32B auf dem M3 mit 24 GB?

Nein. Qwen3 32B braucht selbst stark komprimiert ca. 17,9 GB – mehr, als ein Mac mit M3 (24 GB) bietet.

Läuft Llama 3.3 70B auf dem M3 mit 24 GB?

Nein. Llama 3.3 70B braucht selbst stark komprimiert ca. 36,1 GB – mehr, als ein Mac mit M3 (24 GB) bietet.

Läuft gpt-oss 120B auf dem M3 mit 24 GB?

Nein. gpt-oss 120B braucht selbst stark komprimiert ca. 60,8 GB – mehr, als ein Mac mit M3 (24 GB) bietet.

Läuft Qwen3 30B-A3B auf dem M3 mit 24 GB?

Ja. Qwen3 30B-A3B passt in der Variante Q3 (spürbare Einbußen) komplett in den Speicher (ca. 15,6 GB) und erreicht ca. 37 Tokens/s – nutzbar, aber spürbar langsamer als ein Chat mit ChatGPT.

Andere Mac-Konfigurationen

Alle Mac-Konfigurationen vergleichen →