Lokale KI · Ollama Schritt für Schritt · Kapitel 6 · 3 Min.
Modelle holen, ansehen, loswerden
Sechs Befehle, mit denen du den Überblick behältst — und verhinderst, dass dir die Platte volläuft.
Ollama bedient sich über eine Handvoll Befehle. Du brauchst nicht alle, aber diese sechs solltest du kennen. Sie beantworten die Fragen: Was habe ich? Was läuft gerade? Was kann weg?
Was liegt bei mir?
ollama listZeigt alles, was auf der Platte liegt, mit Größe und Datum. Bei mir sieht das so aus:
| Name | Größe | Zuletzt geändert |
|---|---|---|
gemma3:1b | 815 MB | vor 2 Monaten |
gemma3:4b | 3,3 GB | vor 3 Monaten |
gemma4:e4b | 9,6 GB | vor 4 Monaten |
Das ist der Befehl, den man nach ein paar Wochen Ausprobieren braucht. Modelle herunterzuladen kostet nichts, deshalb sammeln sie sich an.
Was läuft gerade?
ollama psZeigt, welche Modelle gerade im Arbeitsspeicher liegen — und in welcher Spalte
PROCESSOR steht, ob auf Prozessor oder Grafik gerechnet wird. Ist die Liste
leer, liegt nichts im Speicher und der nächste Aufruf wird ein Kaltstart.
ollama ps ist die ehrlichste Antwort auf „warum ist es gerade so langsam“.
Steht das Modell nicht in der Liste, wartest du nicht am Denken, sondern am Laden von der
Festplatte.
Ollama wirft ein Modell nach fünf Minuten Untätigkeit von selbst wieder heraus. Das ist die Voreinstellung, und sie ist der Grund, warum dieselbe Frage morgens dreißig Sekunden dauert und mittags fünf.
Ein neues holen
ollama pull gemma3:4bLädt herunter, ohne gleich zu starten. Brauchst du selten — ollama run lädt
von allein, wenn das Modell fehlt. Praktisch ist es, wenn du abends etwas Großes ziehen und
morgen damit arbeiten willst.
Welche Namen es gibt, steht auf ollama.com/library. Dort findest du auch die
Angaben, die im Kurs vorkommen: Größe, Kontextfenster, ob das Modell Bilder verarbeiten kann.
Was kann das Ding eigentlich?
ollama show gemma3:4bZeigt die technischen Angaben zu einem Modell, das du schon hast: Größe, Kontextfenster, Grundanweisung, Lizenz. Nützlich, wenn du zwei ähnlich klingende Modelle vergleichst und wissen willst, welches wirklich das größere Fenster hat.
Aufräumen
ollama rm gemma4:e4bLöscht ein Modell von der Platte. Endgültig — aber nicht schlimm, du kannst es jederzeit wieder ziehen. Bei einem 9,6-GB-Brocken, den man einmal ausprobiert und nie wieder angefasst hat, ist das die richtige Entscheidung.
Erst ollama list, dann ollama rm. Die Namen ähneln sich, und
ein gemma3:4b statt gemma4:e4b löscht dir ausgerechnet das
Modell, mit dem du arbeitest.
Ein Gespräch beenden
Bist du in einer Sitzung, die mit ollama run begonnen hat, kommst du so
wieder heraus:
/byeDer Schrägstrich ist wichtig — ohne ihn hältst du dem Modell nur das Wort „bye“ hin und bekommst eine höfliche Verabschiedung als Antwort, während die Sitzung weiterläuft.
Wohin die Gigabyte gehen
Von Haus aus landen die Modelle im Benutzerordner auf C:. Wie du das auf ein
anderes Laufwerk legst, stand in Kapitel 5 — es ist eine Zeile und lohnt sich, bevor das
erste große Modell da ist.
Nachsehen, wieviel es tatsächlich ist, kannst du jederzeit im Explorer. Der Ordner heißt
blobs, und die Dateien darin haben kryptische Namen. Nicht von Hand darin
aufräumen — dafür gibt es ollama rm, und das räumt auch die Verweise mit weg.
ollama ps ist die ehrlichste Antwort auf „warum ist es gerade so langsam“ — dort steht, was wirklich geladen ist.
Du willst ein Modell löschen. Welcher Befehl kommt zwingend zuerst?
ollama list. Die Namen ähneln sich stark, und gelöscht ist gelöscht — erst nachsehen, wie das Modell genau heißt, dann entfernen.
Kapitel 6 von 20 · Stand: 13.08.2026
Achtung
In einem Satz