Ollama installieren: Lokale KI in 5 Minuten starten
Mit Ollama läuft eine ChatGPT-ähnliche KI komplett auf deinem eigenen Rechner – kostenlos, offline und ohne dass deine Daten den PC verlassen. Die Installation dauert nur wenige Minuten.
Vorher: Passt deine Hardware?
Ollama läuft auf fast jedem aktuellen Rechner – wie gut, hängt vom Grafikspeicher ab. Prüfe im KI-Hardware-Rechner, welche Modelle auf deiner Grafikkarte oder deinem Mac flüssig laufen. Plane außerdem ein paar Gigabyte freien Festplattenplatz pro Modell ein.
Installation
Windows
- Lade auf ollama.com/download das Windows-Installationsprogramm herunter.
- Starte die Datei und folge dem Installer – Administratorrechte sind nicht nötig.
- Halte den Grafikkartentreiber aktuell (NVIDIA oder AMD), damit Ollama die GPU nutzen kann.
Mac
- Lade die Mac-Version auf ollama.com/download herunter.
- Entpacke sie und ziehe Ollama in den Programme-Ordner.
- Starte Ollama einmal – das Lama-Symbol erscheint in der Menüleiste.
Linux
Öffne ein Terminal und führe das offizielle Installationsskript aus:
curl -fsSL https://ollama.com/install.sh | sh
Das erste Modell starten
Ollama bringt eine eigene Chat-Oberfläche mit: Öffne die App, wähle ein Modell aus der Liste und schreib los. Alternativ geht es im Terminal (Windows: Eingabeaufforderung oder PowerShell):
ollama run qwen3:8b
Beim ersten Aufruf lädt Ollama das Modell herunter (bei Qwen3 8B gut 5 GB), danach startet direkt ein Chat. Mit /bye beendest du ihn. Welches Modell für deine Hardware am besten passt, zeigt der Rechner – dort kannst du den passenden Befehl direkt kopieren.
Die wichtigsten Befehle
| Befehl | Was er tut |
|---|---|
ollama run MODELL | Modell herunterladen (falls nötig) und Chat starten |
ollama pull MODELL | Modell nur herunterladen oder aktualisieren |
ollama list | Alle installierten Modelle anzeigen |
ollama ps | Laufende Modelle anzeigen – inklusive, ob sie auf der GPU oder CPU laufen |
ollama rm MODELL | Modell löschen und Speicherplatz freigeben |
Häufige Probleme
Die KI ist extrem langsam
Prüfe mit ollama ps, ob in der Spalte PROCESSOR „100% GPU“ steht. Steht dort ein CPU-Anteil, ist das Modell zu groß für deinen Grafikspeicher und wird ausgelagert. Wähle ein kleineres Modell – der Rechner zeigt dir, welche komplett passen.
Die Grafikkarte wird gar nicht genutzt
Meist hilft ein aktueller Grafikkartentreiber und ein Neustart von Ollama. Sehr alte oder sehr kleine Grafikkarten werden teilweise nicht unterstützt.
Lieber eine grafische Oberfläche?
Neben der eingebauten Chat-App von Ollama sind LM Studio (eigenständige App mit Modell-Browser) und Open WebUI (ChatGPT-ähnliche Oberfläche im Browser) beliebte Alternativen.