Zum Inhalt springen

Eigene LLMs & KI-Systeme · KI und IT für konkrete Arbeitsaufgaben

Wie wechsle ich in Ollama zwischen Modellen?

Stand 10.10.2026 · 5 Min. Lesezeit

Kurz gesagt

Jedes Modell starten Sie mit «ollama run [modellname]», ein anderes Modell öffnen Sie in einem neuen Fenster oder nach «/bye». Zum fairen Vergleich stellen Sie jedem Modell dieselben Aufgaben und bewerten die Ergebnisse nach festen Kriterien. Laufende Modelle sehen Sie mit «ollama ps».

Das Problem

Sie haben Ollama eingerichtet und ein erstes Modell ausprobiert. Es antwortet brauchbar, aber manchmal zu knapp, manchmal zu langsam, und bei Fachfragen wirkt es unsicher. Nun hören Sie, dass andere Modelle besser seien für Texte, für Zusammenfassungen oder für Deutsch. Sie möchten es selbst ausprobieren.

Doch wie wechselt man zwischen Modellen? Muss man etwas neu installieren? Verliert man dabei Einstellungen? Und wie vergleicht man fair, ohne sich vom Bauchgefühl leiten zu lassen?

Ollama macht den Wechsel einfach: Jedes geladene Modell lässt sich mit einem Befehl starten. Schwieriger ist ein sinnvoller Vergleich. Diese Anleitung zeigt beides: die Technik des Wechsels und ein einfaches Verfahren, mit dem Sie für Ihre Aufgaben das passende Modell finden.

So lösen Sie es mit KI – Schritt für Schritt

  1. Aufgaben festlegen. Notieren Sie drei bis fünf typische Aufgaben, für die Sie die KI nutzen: eine E-Mail entwerfen, einen Text zusammenfassen, eine Frage zu Ihrem Fachgebiet beantworten. Diese Aufgaben sind Ihr Vergleichsmassstab.
  1. Mehrere Modelle bereithalten. Laden Sie ein bis zwei weitere Modelle mit ollama pull [modellname]. Achten Sie auf die Grösse: Sie müssen in Ihren Arbeitsspeicher passen. Siehe Modellgrösse bei lokaler KI.
  1. Vorhandene Modelle ansehen. ollama list zeigt alle geladenen Modelle, ollama ps die gerade laufenden.
  1. Chat mit Modell A starten. ollama run [modellname-A] öffnet den Chat. Stellen Sie Ihre Aufgaben der Reihe nach und kopieren Sie die Antworten in ein Dokument.
  1. Chat beenden oder wechseln. Mit /bye verlassen Sie den Chat. Um ein anderes Modell zu nutzen, starten Sie ollama run [modellname-B]. Sie können auch ein zweites Terminalfenster öffnen. Beachten Sie: Zwei grosse Modelle gleichzeitig brauchen viel Arbeitsspeicher.
  1. Dieselben Aufgaben stellen. Geben Sie jedem Modell denselben Wortlaut. Für den Vergleich ist es wichtig, nichts zu verändern.
  1. Ergebnisse bewerten. Bewerten Sie mit einem festen Raster (Tabelle unten): Richtigkeit, Verständlichkeit, Sprache, Länge, Tempo. Siehe auch Bewertungsraster für KI-Antworten.
  1. Entscheiden und aufräumen. Behalten Sie das Modell, das für Ihre Aufgaben am besten abschneidet, und löschen Sie die anderen, siehe Modelle löschen.

Vorlage zum Kopieren

Mit diesem Auftrag lassen Sie sich ein persönliches Vergleichsblatt erstellen.

Ich möchte in Ollama mehrere lokale KI-Modelle vergleichen. Erstelle ein Vergleichsblatt.

Meine Aufgaben: [3 bis 5 typische Aufgaben]
Meine Anforderungen: [z. B. gutes Deutsch, Schweizer Schreibweise, kurze Antworten, schnell auf meinem Rechner]
Modelle im Vergleich: [Namen der Modelle, die ich teste]

Erstelle:
1. Eine Tabelle mit Zeilen für jede Aufgabe und Spalten für jedes Modell, in die ich meine Bewertung (1 bis 5) und Bemerkungen eintrage.
2. Ein Bewertungsraster mit Kriterien: sachliche Richtigkeit, Verständlichkeit, Sprachqualität, Befolgung meiner Vorgaben, Geschwindigkeit.
3. Eine Anleitung in 5 Sätzen, wie ich den Test fair durchführe (gleicher Wortlaut, gleiche Reihenfolge).
Beurteile nicht selbst, welches Modell besser ist. Das entscheide ich anhand meiner Bewertung.

Das Blatt füllen Sie selbst aus. So bleibt der Vergleich nachvollziehbar und beruht auf Ihren Aufgaben und nicht auf Werbeversprechen.

KriteriumFrage
RichtigkeitStimmen die Aussagen?
VerständlichkeitIst es klar geschrieben?
SpracheGutes Deutsch, Schweizer Schreibweise?
VorgabenHält es sich an Länge und Form?
TempoWie lange dauert die Antwort?

Worauf Sie achten müssen

  • Arbeitsspeicher: Zu grosse Modelle laden nicht oder laufen sehr langsam. Ein zweites Modell im Hintergrund verbraucht weiteren Speicher. Beenden Sie nicht benötigte Modelle mit ollama stop [modellname].
  • Chat zurücksetzen: Beim Wechsel des Modells beginnt ein neuer Chat ohne den alten Verlauf. Müssen Sie Kontext mitnehmen, kopieren Sie ihn. Siehe Wann ein neuer Chat sinnvoll ist.
  • Feste Einstellungen: Ein mit Modelfile angepasstes Modell hat eigene Einstellungen. Ein anderes Modell kennt sie nicht und braucht sie neu.
  • Lizenzen: Nicht jedes Modell erlaubt jede Nutzung. Für den geschäftlichen Einsatz prüfen Sie die Lizenz. Siehe Modelllizenz prüfen.
  • Fehler bleiben möglich: Auch ein gutes Modell irrt. Prüfen Sie wichtige Antworten, unabhängig vom Modell.

Ein Beispiel aus der Praxis

Ein Beispiel: Eine Gemeindeschreiberin im Kanton Thurgau nutzt eine lokale KI, um Entwürfe für Mitteilungen und Protokolle zu erstellen. Das erste Modell antwortet oft in Hochdeutsch mit deutschen Wendungen («Bürgersteig» statt «Trottoir»), und die Texte sind ihr zu lang.

Vorher glaubt sie, es liege an ihrer Fragestellung. Nachher testet sie drei Modelle mit denselben vier Aufgaben, bewertet nach einem Raster und stellt fest: Ein mittelgrosses Modell hält sich besser an Längenvorgaben, ein anderes schreibt natürlicheres Deutsch, ist aber langsamer. Sie entscheidet sich für das erste und löscht das dritte. Für ihren Alltag legt sie zudem feste Regeln fest, etwa «Schweizer Schreibweise, höchstens 120 Wörter». Das Modell wechselt sie nur noch, wenn sich der Bedarf ändert.

So hilft Ihnen Alpasana

Lokale KI mit Ollama und Open-Source-Modellen gehört zur Kursauswahl KI und IT für konkrete Arbeitsaufgaben von absofort. Sie umfasst zudem Bürokommunikation, KI-Agenten und Claude mit Prompt-Bibliothek und Qualitätsprüfung, jeweils mit KI-Lerncoach, Praxisaufgaben und verifizierbarem Abschluss.

Eine Empfehlung für ein bestimmtes Modell gibt dieser Hinweis nicht, denn die Auswahl hängt von Ihren Aufgaben und Ihrem Rechner ab.

Häufige Fragen

Kann ich zwei Modelle gleichzeitig nutzen?

Ja, wenn der Arbeitsspeicher reicht. Ollama kann mehrere Modelle geladen halten. Bei knappem Speicher wird das erste entladen, wenn das zweite startet.

Verliere ich beim Wechsel meine Einstellungen?

Der Chatverlauf der Sitzung geht verloren, weil jedes Modell einen eigenen Chat hat. Feste Einstellungen in einer Modelfile bleiben beim jeweiligen Modell erhalten.

Wie viele Modelle soll ich testen?

Zwei bis drei genügen für den Anfang. Wer zu viele testet, verliert den Überblick und füllt die Festplatte.

Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.

Quellen

Weiterlesen in der Galaxie