Welche KI läuft auf der RX 7900 XT (20 GB)?

Die AMD RX 7900 XT hat 20 GB Grafikspeicher und 800 GB/s Speicherbandbreite. Damit laufen 13 von 22 aktuellen KI-Modellen flüssig.

Kurzfazit

Die RX 7900 XT ist sehr gut für lokale KI geeignet – auch große Modelle laufen flüssig.

Im Rechner mit eigenen Einstellungen prüfen RX 7900 XT bei Amazon ansehen*

Alle Modelle auf der RX 7900 XT im Überblick

Annahmen: 8.000 Tokens Kontext, 32 GB DDR5-Arbeitsspeicher für die Auslagerung, Standard-Quantisierung Q4 (wie bei Ollama). Tempo = geschätzte Tokens pro Sekunde beim Antworten.

ModellErgebnisSpeicherTempoDetails
Qwen3 30B-A3B
Chat · Logik
Läuft flüssig19,1 GBca. 240 Tokens/sQ4 (Standard)
Qwen3-Coder 30B-A3B
Programmieren
Läuft flüssig19,1 GBca. 240 Tokens/sQ4 (Standard)
Mistral Small 3.1 24B
Chat · Bilder
Läuft flüssig15,8 GBca. 33 Tokens/sQ4 (Standard)
gpt-oss 20B
Chat · Logik · Programmieren
Läuft flüssig11,7 GBca. 251 Tokens/sMXFP4 (Original)
Qwen3 14B
Chat · Logik · Programmieren
Läuft flüssig10,5 GBca. 53 Tokens/sQ4 (Standard)
Phi-4 14B
Chat · Logik
Läuft flüssig10,7 GBca. 54 Tokens/sQ4 (Standard)
Gemma 3 12B
Chat · Bilder
Läuft flüssig10,7 GBca. 65 Tokens/sQ4 (Standard)
Mistral Nemo 12B
Chat
Läuft flüssig8,9 GBca. 65 Tokens/sQ4 (Standard)
Qwen3 8B
Chat · Logik · Programmieren
Läuft flüssig6,5 GBca. 97 Tokens/sQ4 (Standard)
Llama 3.1 8B
Chat
Läuft flüssig6,3 GBca. 99 Tokens/sQ4 (Standard)
Gemma 3 4B
Chat · Bilder
Läuft flüssig4,2 GBca. 184 Tokens/sQ4 (Standard)
Qwen3 4B
Chat · Logik
Läuft flüssig4,1 GBca. 198 Tokens/sQ4 (Standard)
Llama 3.2 3B
Chat
Läuft flüssig3,3 GBca. 247 Tokens/sQ4 (Standard)
Qwen3 32B
Chat · Logik · Programmieren
Läuft, etwas langsamer17,9 GBca. 30 Tokens/sQ3 (spürbare Einbußen)
Qwen2.5-Coder 32B
Programmieren
Läuft, etwas langsamer17,9 GBca. 30 Tokens/sQ3 (spürbare Einbußen)
DeepSeek-R1 32B (Distill)
Logik
Läuft, etwas langsamer17,9 GBca. 30 Tokens/sQ3 (spürbare Einbußen)
Gemma 3 27B
Chat · Bilder
Läuft, etwas langsamer17,3 GBca. 36 Tokens/sQ3 (spürbare Einbußen)
Llama 3.3 70B
Chat
Passt nicht––braucht ca. 36,1 GB
Llama 4 Scout
Chat · Bilder
Passt nicht––braucht ca. 53,1 GB
gpt-oss 120B
Chat · Logik · Programmieren
Passt nicht––braucht ca. 60,8 GB
Qwen3 235B-A22B
Chat · Logik · Programmieren
Passt nicht––braucht ca. 112,0 GB
DeepSeek-R1 671B
Logik
Passt nicht––braucht ca. 314,9 GB

Mehr KI mit einem Upgrade

Mini-PC mit Ryzen AI Max+ 395 (128 GB)

Riesige Modelle zum Mini-PC-Preis.

+1 Modelle flüssig, z. B. gpt-oss 120B

Preise bei Amazon ansehen*

* Werbelink: Wenn du über diesen Link kaufst, erhalten wir eine kleine Provision. Für dich ändert sich am Preis nichts.

Häufige Fragen

Reicht die RX 7900 XT (20 GB) für lokale KI?

Die RX 7900 XT ist sehr gut für lokale KI geeignet – auch große Modelle laufen flüssig. Mit 20 GB Grafikspeicher laufen 13 von 22 Modellen flüssig, das stärkste davon ist Qwen3 30B-A3B.

Welches KI-Modell ist das beste für die RX 7900 XT?

Unsere Empfehlung ist Qwen3 30B-A3B: MoE: Qualität eines großen Modells, Tempo eines kleinen. Starten lässt es sich mit dem Befehl „ollama run qwen3:30b“.

Läuft Qwen3 32B auf der RX 7900 XT?

Ja. Qwen3 32B passt in der Variante Q3 (spürbare Einbußen) komplett in den Speicher (ca. 17,9 GB) und erreicht ca. 30 Tokens/s – nutzbar, aber spürbar langsamer als ein Chat mit ChatGPT.

Läuft Llama 3.3 70B auf der RX 7900 XT?

Nein. Llama 3.3 70B braucht selbst stark komprimiert ca. 36,1 GB – mehr, als die RX 7900 XT bietet.

Läuft gpt-oss 20B auf der RX 7900 XT?

Ja. gpt-oss 20B passt in der Variante MXFP4 (Original) komplett in den Speicher (ca. 11,7 GB) und erreicht ca. 251 Tokens/s – das fühlt sich flüssig an.

Läuft Qwen3 14B auf der RX 7900 XT?

Ja. Qwen3 14B passt in der Variante Q4 (Standard) komplett in den Speicher (ca. 10,5 GB) und erreicht ca. 53 Tokens/s – das fühlt sich flüssig an.

Ähnliche Grafikkarten

Alle Grafikkarten vergleichen →