LM Studio installieren, einmal öffnen, lms server start ausführen und http://localhost:1234/v1/models abfragen: Kommt eine Liste zurück, läuft der Server, und mit den Werkseinstellungen erreicht ihn nur Ihr eigener Rechner. Von den 5 Programmen, die wir vergleichen, ist es ab Werk am dichtesten verschlossen, bei allem, was sich einstellen lässt. Und es ist das einzige, dessen Netzwerkverhalten niemand außerhalb der Firma prüfen kann.
Beide Hälften zählen bei der Einrichtung. Die erste sagt Ihnen, was Sie in Ruhe lassen sollten; die zweite, was Sie ungeprüft glauben müssen. Diese Anleitung geht in der Reihenfolge Installation, Server, Prüfung, Netzwerk vor, mit der Version, die LM Studios Download-Dienst am 25. September 2026 auslieferte, 0.4.25-1, und mit dem Kommandozeilenwerkzeug lms in dem Stand, den sein öffentliches Repository am 24. September 2026 hatte.
LM Studio installieren unter macOS, Windows und Linux
Es gibt einen Installer pro System und dazu ein Skript für den Betrieb ohne Fenster.
| System | Was Sie herunterladen | Was es voraussetzt |
|---|---|---|
| macOS | LM-Studio-0.4.25-1-arm64.dmg |
Apple Silicon und macOS 14.0 oder neuer; empfohlen sind 16 GB Arbeitsspeicher, 8 GB reichen für kleinere Modelle und mäßige Kontextlängen. Intel-Macs werden nicht unterstützt: Der Download-Dienst antwortet ihnen mit einem Fehler |
| Windows | LM-Studio-0.4.25-1-x64.exe oder die ARM64-Version für Rechner mit Snapdragon X Elite |
Auf x64 ein Prozessor mit AVX2. Empfohlen: 16 GB RAM und 4 GB dedizierter Grafikspeicher |
| Linux | LM-Studio-0.4.25-1-x64.AppImage oder LM-Studio-0.4.25-1-arm64.AppImage |
Ubuntu 20.04 oder neuer. Kein .deb, kein .rpm. LM Studio selbst sagt, dass Versionen nach 22 nicht gut getestet sind |
| Alle, ohne Fenster | curl -fsSL https://lmstudio.ai/install.sh | bash (Linux, Mac) oder irm https://lmstudio.ai/install.ps1 | iex (Windows) |
Installiert llmster, den Modellserver von LM Studio als Hintergrunddienst, ohne dass Sie die App herunterladen. Unter Linux und Mac legt das Skript ihn in ~/.lmstudio/bin ab und nimmt diesen Ordner in Ihren PATH auf |
Dateinamen so, wie LM Studios Download-Dienst sie am 25. September 2026 für jedes System auslieferte; Voraussetzungen laut den Seiten System Requirements und Headless, am selben Tag gelesen. Das llmster-Skript dieses Tages installiert Version 0.0.25-1.
Ein Name, zwei Programme. Seit Juli 2026 gibt es zusätzlich LM Studio Bionic, eine eigenständige Anwendung nur für Windows x64 und macOS ARM64. Diese Anleitung behandelt ausschließlich LM Studio. Steht in einem Download-Link bionic, ist es das andere Programm.
Das erste Modell in 3 Schritten, und GGUF oder MLX
In der App sind es 3 Schritte ohne Terminal: ein Modell im Tab Discover suchen, laden und im Tab Chat loslegen. Nachdenken lohnt sich beim Format. LM Studio führt GGUF-Dateien über llama.cpp aus, unter macOS, Windows und Linux; auf Apple Silicon kann es zusätzlich MLX-Dateien mit seiner eigenen MLX-Engine ausführen, die quelloffen unter MIT-Lizenz steht. Im Terminal grenzen lms get --gguf oder lms get --mlx die Suche auf eines der beiden Formate ein; ohne diese Optionen richten sich die Treffer nach den installierten Engines.
Zweimal prüfen, ob es passt. Vor dem Download sagt Ihnen der Modellfinder, welche Modelle auf Ihren Rechner passen, mit den echten veröffentlichten Dateigrößen in Q4_K_M, unserer Qualitätsuntergrenze, plus dem Speicher, den das Gespräch selbst belegt. Vor dem Laden gibt lms load --estimate-only <Modell> die Speicherschätzung von LM Studio selbst aus und lädt nichts. Die Größen im Modellfinder sind GGUF-Dateien; die MLX-Fassung desselben Modells ist eine andere Datei. Auf dem Mac ist der Modellfinder deshalb die Richtgröße, nicht die exakte Zahl.
Den LM-Studio-Server starten: Tab Developer oder lms server start
In der App hat der Tab Developer den Schalter Start server. Im Terminal:
lms server start
Der Befehl lms kommt mit der App, funktioniert aber erst, nachdem Sie LM Studio mindestens einmal geöffnet haben. Danach startet jeder lms-Befehl LM Studio im Hintergrund, falls es nicht läuft.
Der Port ist 1234, bis Sie ihn ändern. Ohne --port nimmt lms server start den zuletzt benutzten Port und fällt nur dann auf 1234 zurück, wenn es keinen gibt. Wer einmal --port 3000 ausprobiert hat, ist immer noch auf 3000. Dieses Verhalten steht im öffentlichen Code von lms; der Server dahinter ist geschlossen.
Damit der Server ohne Fenster weiterläuft, hat die App eine Einstellung, die den Server bei der Anmeldung startet: Beim Schließen wandert die App dann in den Infobereich, der Server läuft weiter, und beim nächsten Start stellt LM Studio den letzten Zustand des Servers wieder her. Für einen Linux-Rechner ohne Bildschirm dokumentiert LM Studio eine systemd-Unit, die lms daemon up ausführt, mit lms load ein Modell lädt und dann lms server start aufruft. Die Unit gehört nach /etc/systemd/system/lmstudio.service und wird so geprüft:
systemctl status lmstudio
Prüfen, ob der LM-Studio-Server läuft
3 Prüfungen, von der schnellsten zur nützlichsten:
lms server status
curl http://localhost:1234/v1/models
lms ps
lms server status antwortet The server is running on port 1234. oder The server is not running.; mit --json gibt es {"running":true,"port":1234} aus, genau das Richtige für ein Skript. Dahinter fragt lms beim Server /lmstudio-greeting ab und wartet 500 Millisekunden auf eine Antwort, die sich als LM Studio ausweist. lms status liefert dieselbe Antwort und dazu die Modelle im Speicher.
Die curl-Zeile ist die, die LM Studio in seiner eigenen Einrichtungsanleitung verwendet. Was sie auflistet, hängt von einer Einstellung ab: Mit Just-in-Time-Laden, das ab Werk eingeschaltet ist, kann /v1/models alle heruntergeladenen Modelle zeigen, nicht nur die geladenen. Was wirklich im Speicher liegt, mit Pfad und Größe, zeigt lms ps; lms ls listet, was auf der Platte liegt.
Modelle entladen sich selbst, manchmal. Ein Modell, das durch eine Anfrage geladen wurde, bleibt 60 Minuten ohne Anfrage im Speicher, und ab Werk entlädt ein zweites, auf diesem Weg geladenes Modell das erste. Ein mit lms load geladenes Modell hat keinen Timer: Es bleibt, bis Sie lms unload ausführen, oder bis zu der Zeit, die Sie ihm mit --ttl in Sekunden mitgeben:
lms load <Modell> --ttl 3600
Einen OpenAI-Client auf localhost:1234 umstellen
Jedes Werkzeug, das mit der OpenAI-API spricht, spricht auch mit LM Studio, wenn Sie die Basis-URL ändern:
http://localhost:1234/v1
Der Server beantwortet /v1/models, /v1/chat/completions, /v1/responses, /v1/completions und /v1/embeddings. Er versteht außerdem das Anthropic-Format unter /v1/messages und hat eine eigene REST-API unter /api/v1. Ins Feld model gehört der Schlüssel, den lms ls anzeigt, oder der Name, den Sie mit lms load <Modell> --identifier mein-modell vergeben.
Im eigenen Netz bereitstellen: bind 0.0.0.0, API-Tokens und CORS
Ab Werk lauscht der Server auf 127.0.0.1:1234, verlangt kein Passwort und hat CORS ausgeschaltet. Das ist der beste Ausgangspunkt der 5 Programme, die wir vergleichen, und die Einrichtung besteht vor allem darin, daran nichts zu ändern.
Um andere Rechner hereinzulassen, hat die App die Einstellung Serve on Local Network, und im Terminal gibt es:
lms server start --bind 0.0.0.0
lms übernimmt die Adresse auch aus der Variable LMS_SERVER_HOST und warnt bei jeder Adresse außer 127.0.0.1: Server will accept connections from the network. Ab diesem Moment kann jeder, der Port 1234 erreicht, Ihre Modelle benutzen, denn ein Passwort gibt es immer noch nicht. Schalten Sie vorher die Authentifizierung ein: Tab Developer, Server Settings, Require Authentication, dann Manage Tokens, um eines anzulegen. Jedes Token hat eigene Berechtigungen, wird nur einmal angezeigt und gehört in den Header Authorization: Bearer. Tokens setzen LM Studio 0.4.0 oder neuer voraus.
CORS ist die andere Tür. lms server start --cors gibt es für Webanwendungen und manche Editor-Erweiterungen, und die Kommandozeile sagt es unverblümt: CORS is enabled. This means any website you visit can use the LM Studio server. Also: Jede Website, die Sie besuchen, kann Ihren Server benutzen. Schalten Sie es nur ein, solange Sie es brauchen. Eine weitere Einstellung hängt am Token: API-Clients die MCP-Server aus Ihrer mcp.json aufrufen zu lassen, geht nur mit eingeschalteter Authentifizierung, und LM Studios eigene Dokumentation warnt, dass manche MCP-Server Code ausführen und Ihre lokalen Dateien lesen können.
Wo LM Studio Modelle, Chats und Logs ablegt
| Was | Wo |
|---|---|
| Modelle | ~/.lmstudio/models/<Herausgeber>/<Modell>/, änderbar im Tab My Models |
| Chats, als einfaches JSON | ~/.lmstudio/conversations/ unter macOS und Linux, %USERPROFILE%\.lmstudio\conversations unter Windows |
| Presets aus dem Hub | ~/.lmstudio/hub (%USERPROFILE%\.lmstudio\hub unter Windows) |
Der Befehl lms, wenn llmster ihn installiert hat |
~/.lmstudio/bin |
Pfade so, wie LM Studios Dokumentation sie veröffentlicht, gelesen am 25. September 2026.
LM Studio sagt, dass nichts, was Sie in einen Chat tippen, Ihr Gerät verlässt, und gibt für diese JSON-Dateien keine Verschlüsselung an: Jedes Programm, das Ihren Benutzerordner lesen kann, liest alle Ihre Chats. Eine GGUF-Datei, die Sie anderswo geladen haben, kommt mit lms import <datei.gguf> hinein, noch als experimentell markiert.
Für Logs müssen Sie keinen Pfad suchen. lms log stream zeigt den exakten Text, der ins Modell hinein- und herausgeht, lms log stream --source server zeigt das Log des Servers selbst, und --stats ergänzt die Kennzahlen jeder Antwort, sofern es welche gibt.
Was LM Studio von sich aus sendet, und was niemand prüfen kann
Laut LM Studios eigener Dokumentation gehen 2 Verbindungen hinaus, ohne dass Sie etwas tun. Die eine ist die Suche nach App-Updates bei jedem Öffnen unter macOS und Windows; Linux hat noch keinen eingebauten Updater. Die andere ist die Suche nach neuen Versionen der Inferenz-Engines, die sich selbst aktualisieren, sofern Sie das nicht in den App-Einstellungen (App Settings) abschalten. Die Datenschutzerklärung sagt, was die Update-Prüfung mitschickt: App-Version und Build, Betriebssystem und Ihre IP-Adresse.
Alles andere wartet auf Sie. Die Suche im Tab Discover und die Statistiken seines Katalogs rufen huggingface.co auf. Der Hub setzt eine Anmeldung voraus, die Websuche ebenfalls, die Cloud-Funktionen ein bezahltes Abo, und LM Link läuft nur, wenn Sie es einschalten.
Was LM Studio nicht veröffentlicht, ist eine Summe: wie viele Aufrufe am Tag das ergibt. Unser Datenblatt LM Studio: was es nach Hause sendet und ob es prüfbar ist lässt seinen 24-Stunden-Streifen genau deshalb leer: Die Zahl gibt es nicht, und das ist nicht dasselbe wie null. Einen dokumentierten Schalter für die Update-Prüfung haben wir nicht gefunden.
Der Einwand ist berechtigt. LM Studio sagt, die Anwendung enthalte keine Telemetrie, und Chat, Dokumente und lokaler Server funktionieren ganz ohne Verbindung. Wir sagen nicht, dass das falsch ist. Wir sagen, dass es das Wort des Herstellers ist: Seine Nutzungsbedingungen vom 23. August 2026 bezeichnen den Code als Geschäftsgeheimnis und verbieten Reverse Engineering, erlauben die App aber kostenlos für private und interne geschäftliche Nutzung. Und alles, was das Datenblatt zum Netzwerk sagt, wurde mit Version 0.4.21-2 erhoben, der Version vom 25. August, nicht an 0.4.25-1. Wenn Sie ein Programm brauchen, dessen Aufrufe Sie selbst zählen können: Ollama lokal einrichten, prüfen, ob es läuft, und sehen, was es sendet hat die Zahl für Ollama, 30 am Tag bei geöffneter App.
Die Reihenfolge, die Ihnen ein funktionierendes und verschlossenes LM Studio hinterlässt:
- Für Ihr System installieren, einmal öffnen und
lms server statusprüfen. - Das Modell mit dem Modellfinder auswählen, mit
lms load --estimate-onlybestätigen und laden. curl http://localhost:1234/v1/modelstesten und den Client auf/v1richten.- Vor jedem
--bind 0.0.0.0Require Authentication einschalten und ein Token anlegen. --corsausgeschaltet lassen, außer eine Webanwendung braucht es, und dann nur so lange wie nötig.
Die 5 Programme werden genau hierin verglichen unter 5 Programme für lokale KI: Telemetrie, Aufrufe, Audit, und wer auf dem Mac arbeitet, findet im Datenblatt zu MLX Apples eigenes Framework für das andere Format, das LM Studio ausführt.