Zum Inhalt springen
Roland Hecht
Kapitel 6 von 20 — Inhaltsverzeichnis

Lokale KI · Ollama Schritt für Schritt · Kapitel 6 · 3 Min.

Stimmungsbild zum Teil Ollama Schritt für Schritt

Modelle holen, ansehen, loswerden

Sechs Befehle, mit denen du den Überblick behältst — und verhinderst, dass dir die Platte volläuft.

Ollama bedient sich über eine Handvoll Befehle. Du brauchst nicht alle, aber diese sechs solltest du kennen. Sie beantworten die Fragen: Was habe ich? Was läuft gerade? Was kann weg?

Was liegt bei mir?

ollama list

Zeigt alles, was auf der Platte liegt, mit Größe und Datum. Bei mir sieht das so aus:

NameGrößeZuletzt geändert
gemma3:1b815 MBvor 2 Monaten
gemma3:4b3,3 GBvor 3 Monaten
gemma4:e4b9,6 GBvor 4 Monaten

Das ist der Befehl, den man nach ein paar Wochen Ausprobieren braucht. Modelle herunterzuladen kostet nichts, deshalb sammeln sie sich an.

Was läuft gerade?

ollama ps

Zeigt, welche Modelle gerade im Arbeitsspeicher liegen — und in welcher Spalte PROCESSOR steht, ob auf Prozessor oder Grafik gerechnet wird. Ist die Liste leer, liegt nichts im Speicher und der nächste Aufruf wird ein Kaltstart.

Merke

ollama ps ist die ehrlichste Antwort auf „warum ist es gerade so langsam“. Steht das Modell nicht in der Liste, wartest du nicht am Denken, sondern am Laden von der Festplatte.

Ollama wirft ein Modell nach fünf Minuten Untätigkeit von selbst wieder heraus. Das ist die Voreinstellung, und sie ist der Grund, warum dieselbe Frage morgens dreißig Sekunden dauert und mittags fünf.

Ein neues holen

ollama pull gemma3:4b

Lädt herunter, ohne gleich zu starten. Brauchst du selten — ollama run lädt von allein, wenn das Modell fehlt. Praktisch ist es, wenn du abends etwas Großes ziehen und morgen damit arbeiten willst.

Welche Namen es gibt, steht auf ollama.com/library. Dort findest du auch die Angaben, die im Kurs vorkommen: Größe, Kontextfenster, ob das Modell Bilder verarbeiten kann.

Was kann das Ding eigentlich?

ollama show gemma3:4b

Zeigt die technischen Angaben zu einem Modell, das du schon hast: Größe, Kontextfenster, Grundanweisung, Lizenz. Nützlich, wenn du zwei ähnlich klingende Modelle vergleichst und wissen willst, welches wirklich das größere Fenster hat.

Aufräumen

ollama rm gemma4:e4b

Löscht ein Modell von der Platte. Endgültig — aber nicht schlimm, du kannst es jederzeit wieder ziehen. Bei einem 9,6-GB-Brocken, den man einmal ausprobiert und nie wieder angefasst hat, ist das die richtige Entscheidung.

Achtung

Erst ollama list, dann ollama rm. Die Namen ähneln sich, und ein gemma3:4b statt gemma4:e4b löscht dir ausgerechnet das Modell, mit dem du arbeitest.

Ein Gespräch beenden

Bist du in einer Sitzung, die mit ollama run begonnen hat, kommst du so wieder heraus:

/bye

Der Schrägstrich ist wichtig — ohne ihn hältst du dem Modell nur das Wort „bye“ hin und bekommst eine höfliche Verabschiedung als Antwort, während die Sitzung weiterläuft.

Wohin die Gigabyte gehen

Von Haus aus landen die Modelle im Benutzerordner auf C:. Wie du das auf ein anderes Laufwerk legst, stand in Kapitel 5 — es ist eine Zeile und lohnt sich, bevor das erste große Modell da ist.

Nachsehen, wieviel es tatsächlich ist, kannst du jederzeit im Explorer. Der Ordner heißt blobs, und die Dateien darin haben kryptische Namen. Nicht von Hand darin aufräumen — dafür gibt es ollama rm, und das räumt auch die Verweise mit weg.

In einem Satz

ollama ps ist die ehrlichste Antwort auf „warum ist es gerade so langsam“ — dort steht, was wirklich geladen ist.

Du willst ein Modell löschen. Welcher Befehl kommt zwingend zuerst?

ollama list. Die Namen ähneln sich stark, und gelöscht ist gelöscht — erst nachsehen, wie das Modell genau heißt, dann entfernen.

Kapitel 6 von 20 · Stand: 13.08.2026