Grafikkarten für lokale KI im Vergleich

Wie viele KI-Modelle laufen auf welcher Grafikkarte flüssig? Die Tabelle vergleicht 36 Grafikkarten von NVIDIA, AMD und Intel – sortiert nach Grafikspeicher (VRAM), dem wichtigsten Faktor für lokale KI.

GrafikkarteVRAMBandbreiteModelle flüssigEmpfehlung
NVIDIA RTX 5090 (32 GB)32 GB1792 GB/s17Qwen3 32B
NVIDIA RTX 3090 (24 GB)24 GB936 GB/s17Qwen3 32B
NVIDIA RTX 3090 Ti (24 GB)24 GB1008 GB/s17Qwen3 32B
NVIDIA RTX 4090 (24 GB)24 GB1008 GB/s17Qwen3 32B
AMD RX 7900 XTX (24 GB)24 GB960 GB/s17Qwen3 32B
AMD RX 7900 XT (20 GB)20 GB800 GB/s13Qwen3 30B-A3B
NVIDIA RTX 4060 Ti (16 GB)16 GB288 GB/s10gpt-oss 20B
NVIDIA RTX 4070 Ti Super (16 GB)16 GB672 GB/s10gpt-oss 20B
NVIDIA RTX 4080 / 4080 Super (16 GB)16 GB736 GB/s10gpt-oss 20B
NVIDIA RTX 5060 Ti (16 GB)16 GB448 GB/s10gpt-oss 20B
NVIDIA RTX 5070 Ti (16 GB)16 GB896 GB/s10gpt-oss 20B
NVIDIA RTX 5080 (16 GB)16 GB960 GB/s10gpt-oss 20B
AMD RX 7600 XT (16 GB)16 GB288 GB/s10gpt-oss 20B
AMD RX 7800 XT (16 GB)16 GB624 GB/s10gpt-oss 20B
AMD RX 7900 GRE (16 GB)16 GB576 GB/s10gpt-oss 20B
AMD RX 9060 XT (16 GB)16 GB322 GB/s10gpt-oss 20B
AMD RX 9070 / 9070 XT (16 GB)16 GB640 GB/s10gpt-oss 20B
Intel Arc A770 (16 GB)16 GB560 GB/s10gpt-oss 20B
NVIDIA RTX 3060 (12 GB)12 GB360 GB/s9Qwen3 14B
NVIDIA RTX 3080 (12 GB)12 GB912 GB/s9Qwen3 14B
NVIDIA RTX 4070 / 4070 Super (12 GB)12 GB504 GB/s9Qwen3 14B
NVIDIA RTX 4070 Ti (12 GB)12 GB504 GB/s9Qwen3 14B
NVIDIA RTX 5070 (12 GB)12 GB672 GB/s9Qwen3 14B
AMD RX 7700 XT (12 GB)12 GB432 GB/s9Qwen3 14B
Intel Arc B580 (12 GB)12 GB456 GB/s9Qwen3 14B
NVIDIA RTX 2080 Ti (11 GB)11 GB616 GB/s7Qwen3 14B
NVIDIA RTX 3080 (10 GB)10 GB760 GB/s6Mistral Nemo 12B
NVIDIA RTX 2070 (8 GB)8 GB448 GB/s5Qwen3 8B
NVIDIA RTX 3060 Ti (8 GB)8 GB448 GB/s5Qwen3 8B
NVIDIA RTX 3070 (8 GB)8 GB448 GB/s5Qwen3 8B
NVIDIA RTX 4060 (8 GB)8 GB272 GB/s5Qwen3 8B
NVIDIA RTX 4060 Ti (8 GB)8 GB288 GB/s5Qwen3 8B
NVIDIA RTX 5060 (8 GB)8 GB448 GB/s5Qwen3 8B
AMD RX 7600 (8 GB)8 GB288 GB/s5Qwen3 8B
NVIDIA GTX 1660 (6 GB)6 GB192 GB/s3Gemma 3 4B
NVIDIA RTX 2060 (6 GB)6 GB336 GB/s3Gemma 3 4B

Bewertet wurden 22 Modelle bei 8.000 Tokens Kontext. „Flüssig“ heißt: komplett im Grafikspeicher und mindestens 15 Tokens pro Sekunde.

Welche Grafikkarte soll ich kaufen?

Für lokale KI zählt vor allem der Grafikspeicher: Er entscheidet, wie große – und damit wie kluge – Modelle komplett auf die Karte passen. Erst danach kommt die Speicherbandbreite, die das Tempo bestimmt. Eine ausführliche Kaufberatung mit Empfehlungen für jedes Budget findest du im Ratgeber Beste Grafikkarte für lokale KI.