Zum Inhalt springen

Eigene LLMs & KI-Systeme · KI und IT für konkrete Arbeitsaufgaben

Wie nutzen andere Programme die lokale API von LM Studio?

Stand 10.10.2026 · 5 Min. Lesezeit

Kurz gesagt

LM Studio kann einen lokalen Server starten, der dieselbe Art von Schnittstelle anbietet wie Cloud-Dienste. Andere Programme auf Ihrem Rechner schicken dann Aufträge an die Adresse des Servers (Standard: Port 1234) und erhalten die Antwort des lokal geladenen Modells. Sie starten den Server, laden ein Modell und prüfen die Verbindung.

Das Problem

Frau Müller arbeitet in der Administration eines Architekturbüros in Lugano und Zürich. Sie hat LM Studio installiert, ein Programm mit einer Chat-Oberfläche für lokale KI-Modelle, und ist mit den Ergebnissen zufrieden. Nun möchte der IT-Verantwortliche, dass auch ein internes Werkzeug, etwa eine Formularanwendung, das Modell nutzen kann. Er sagt: «Dann müssen wir den API-Server starten.» Frau Müller fragt sich, was das bedeutet und ob es sicher ist.

Ein «Server» ist hier nichts Grosses, sondern ein Dienst, der im Hintergrund auf Anfragen wartet. Die «API» ist die Schnittstelle, über die andere Programme Aufträge schicken können. Im Chat-Fenster tippen Sie selbst, über den Server tippt das andere Programm.

Hier lesen Sie, wie das Schritt für Schritt geht und worauf Sie achten sollten, damit nur die gewünschten Programme Zugriff haben.

So lösen Sie es mit KI – Schritt für Schritt

  1. Modell auswählen und laden. Der Server beantwortet nur Aufträge, wenn ein Modell geladen ist. Siehe LM Studio: Modell auswählen. Verwenden Sie zum Testen ein kleines Modell.
  1. Den Server-Bereich öffnen. In neueren Versionen von LM Studio finden Sie die Server-Einstellungen im Bereich für Entwickler («Developer»). Die genaue Bezeichnung kann sich zwischen Versionen unterscheiden. Prüfen Sie die aktuelle Dokumentation.
  1. Server starten. Schalten Sie den Server ein. LM Studio zeigt die Adresse an, standardmässig http://localhost:1234. «localhost» heisst: derselbe Rechner.
  1. Zugriff begrenzen. Lassen Sie den Server zunächst nur auf dem eigenen Rechner erreichbar. Eine Freigabe für das Firmennetz ist nur sinnvoll, wenn der Zugang geschützt wird.
  1. Verbindung testen. Rufen Sie die Liste der Modelle über die Adresse ab, zum Beispiel http://localhost:1234/v1/models im Browser. Erscheint eine Liste mit Ihrem Modell, läuft der Server.
  1. Erste Anfrage senden. Ihre IT-Person schickt einen kurzen Auftrag an die Chat-Schnittstelle (/v1/chat/completions) und prüft die Antwort. Ein Muster steht unten.
  1. Das andere Programm einrichten. Tragen Sie dort Adresse und Modellname ein. Viele Programme, die sonst Cloud-KI nutzen, lassen sich durch Ändern der Adresse umstellen. Mehr: API-Kompatibilität prüfen.
  1. Im Alltag beobachten. Achten Sie auf Antwortzeit, Speicherverbrauch und Fehlermeldungen, und lassen Sie den Server nur laufen, wenn er gebraucht wird.

Vorlage zum Kopieren

Ein Testaufruf für Ihre IT-Person, um zu prüfen, ob der Server antwortet. Er lässt sich in einem Terminalfenster ausführen:

curl http://localhost:1234/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "model": "[Modellname laut LM Studio]",
    "messages": [
      {"role": "system", "content": "Antworte auf Deutsch (Schweiz), kurz und sachlich."},
      {"role": "user", "content": "[Testfrage, z. B. Nenne drei Vorteile eines Wochenplans]"}
    ],
    "temperature": 0.3
  }'

Ersetzen Sie Modellname und Testfrage. Erscheint eine Antwort in der Ausgabe, funktioniert der Server. Bei Fehlern prüfen Sie, ob der Server gestartet und das Modell geladen ist und ob die Adresse stimmt.

Worauf Sie achten müssen

  • Nur so offen wie nötig: Ein lokaler Server ohne Anmeldung kann von jedem Programm auf dem Rechner genutzt werden. Geben Sie ihn nicht ohne Schutz ins Firmennetz frei, und nie ins Internet. Siehe API-Anmeldung schützen.
  • Modell muss geladen sein: Ohne geladenes Modell antwortet der Server mit einem Fehler oder lädt eines, was dauern kann.
  • Ein Rechner, begrenzte Leistung: Mehrere gleichzeitige Aufträge bremsen sich gegenseitig. Siehe Gleichzeitige Nutzer und Hardware.
  • Datenschutz: Die Daten bleiben auf dem Rechner, aber andere Programme sehen Ihre Aufträge. Prüfen Sie, welche Programme zugreifen.
  • Qualität prüfen: Das Modell kann sich irren. Zeigen Sie Antworten als Vorschlag.
  • Rechner ist nicht immer an: Ist der Rechner ausgeschaltet oder gesperrt, steht auch der Dienst still. Das gilt besonders für Laptops.
EinstellungBedeutungEmpfehlung für den Start
Server startenDienst wartet auf AufträgeNur bei Bedarf
Adresse localhostNur dieser RechnerJa
Erreichbar im NetzAndere Rechner können zugreifenNur mit Schutz
Port 1234StandardanschlussBei Konflikten ändern
Modell geladenAntworten möglichVor Test laden

Ein Beispiel aus der Praxis

Ein Beispiel: Das Architekturbüro nutzt LM Studio auf einem Arbeitsplatzrechner mit starker Grafikkarte. Der IT-Verantwortliche startet den Server, lädt ein mittelgrosses Modell und lässt die interne Formularanwendung kurze Projektbeschreibungen verbessern. Der Dienst ist nur vom selben Rechner aus erreichbar.

Vorher: Die Beschreibungen werden von Hand überarbeitet, manche Kolleginnen kopieren sie in öffentliche Chat-Dienste. Nachher: Die Verbesserung läuft lokal und dauert wenige Sekunden. Frau Müller stellt beim Testen fest, dass bei gleichzeitiger Nutzung durch zwei Personen die Antwort langsamer wird. Das Büro regelt, dass die Funktion nur zu den Bürozeiten genutzt wird, und prüft später einen eigenen kleinen Server.

So hilft Ihnen Alpasana

Wer lokale KI mit LM Studio ausprobieren und für Arbeitsaufgaben nutzen möchte, findet bei absofort passende Kurse. Die Kurse für KI und IT bei konkreten Arbeitsaufgaben umfassen laut Angebot lokale KI mit Ollama und Open-Source-Modellen, No-Code-Automatisierung und KI-Agenten. Mit KI-Lerncoach und Praxisaufgaben lernen Sie im eigenen Tempo.

Am Ende steht ein verifizierbarer Abschluss.

Häufige Fragen

Ist der Server sicher, wenn er nur «localhost» nutzt?

Er ist vom Netz aus nicht erreichbar, aber alle Programme auf demselben Rechner können ihn nutzen. Das ist für den Start meist in Ordnung, bei gemeinsam genutzten Rechnern jedoch zu prüfen.

Warum funktioniert mein Programm nicht, obwohl der Server läuft?

Häufige Ursachen: falscher Modellname, falsche Adresse, kein Modell geladen oder eine Firewall. Prüfen Sie diese vier Punkte, bevor Sie weiter suchen.

Was ist besser, LM Studio oder Ollama?

Das hängt vom Einsatz ab: LM Studio ist stark bei der grafischen Bedienung, Ollama bei Betrieb als Dienst. Siehe Ollama oder LM Studio.

Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.

Quellen

Weiterlesen in der Galaxie