Programme

Fünf Programme, die ein Modell auf Ihrem eigenen Rechner ausführen. Diese Tabelle beantwortet, was die Herstellerseiten nicht beantworten: ob sie ungefragt Nutzungsdaten senden, wen sie sonst noch anrufen, auf welcher Adresse sie lauschen und vor allem, ob das jemand von außen überprüfen kann. Alles hier wurde am 25. August 2026 im veröffentlichten Quellcode und in der offiziellen Dokumentation gelesen; nichts stammt aus der Beobachtung des Netzverkehrs.

Die vier Fragen, auf die es ankommt

ProgrammTelemetrie ab WerkAndere Rufe nach HauseAuf welcher Adresse es lauschtLässt es sich überprüfen?
OllamaKeine Fremd-Analytik, ruft aber nach Hause
von uns geprüft
Update-Prüfung stündlich (nicht abschaltbar) und entfernter Katalog alle 4 h (OLLAMA_NO_CLOUD)
von uns geprüft
127.0.0.1:11434, ohne Schlüssel, freizügiges CORS
von uns geprüft
Ja — MIT, öffentlicher Code
von uns geprüft
LM StudioErklärt, keine zu haben
Herstellerangabe
Update-Prüfung (kein dokumentierter Schalter) und Modellsuche
Herstellerangabe
127.0.0.1:1234, ohne Schlüssel, aber CORS aus und API-Schlüssel verfügbar
Herstellerangabe
Nein — geschlossener Code, Reverse Engineering verboten
von uns geprüft
llama.cppÜberhaupt keine
von uns geprüft
Keine: weder Update-Prüfung noch sonst etwas
von uns geprüft
127.0.0.1:8080, ohne Schlüssel, CORS spiegelt jeden Ursprung
von uns geprüft
Ja — MIT, öffentlicher Code
von uns geprüft
MLX (mlx-lm)Keine eigene; erbt die der Download-Bibliothek
von uns geprüft
Nur der Modell-Download (HF_HUB_DISABLE_TELEMETRY / HF_HUB_OFFLINE)
von uns geprüft
127.0.0.1:8080, ohne Schlüssel, CORS sperrangelweit offen
von uns geprüft
Ja — MIT, öffentlicher Code
von uns geprüft
vLLMJa, ab Werk eingeschaltet — Herzschlag alle 10 Min. an stats.vllm.ai
von uns geprüft
Modell-Download mit Selbstidentifikation als vLLM gegenüber Hugging Face; lokaler Metrik-Endpunkt
von uns geprüft
0.0.0.0:8000 — alle Schnittstellen, ohne Schlüssel
von uns geprüft
Ja — Apache-2.0, öffentlicher Code
von uns geprüft

Jede Zelle dieser vier Spalten sagt, woher wir es wissen: ● von uns an der Primärquelle geprüft, ◐ Herstellerangabe ohne unabhängige Prüfung, ○ konnten wir nicht überprüfen. Lesen Sie die letzte Spalte zuerst: Eines dieser fünf kann niemand außerhalb des Unternehmens überprüfen, und das macht aus seiner ganzen Zeile ein Versprechen statt einer Tatsache. Nichts davon stammt aus der Beobachtung des Netzverkehrs — wir haben den veröffentlichten Quellcode und die offizielle Dokumentation gelesen.

Alles Übrige

ProgrammWas es löstWo es läuftWas es beschleunigtFormateSchritte bis zum ersten TokenLizenzWas auf Ihrer Festplatte bleibt
OllamaEin Modell, das in zwei Minuten antwortet, ohne Parameter anzufassen.Windows · macOS Apple Silicon · macOS Intel (nur CPU) · Linux (ohne Desktop-App)CUDA, ROCm, Metal, Vulkan (ab Werk an), CPU. Kein NPU.GGUF und safetensors2 Schritte, ohne KompilierenMITJa: Gespräche in einer unverschlüsselten SQLite-Datenbank
LM StudioAlles auf dem Bildschirm, ohne Kommandozeile.Windows (AVX2) · macOS Apple Silicon · macOS Intel nein · Linux (nur AppImage)CUDA, ROCm, Metal, Vulkan, CPU — laut Quelle von Januar 2025. NPU: ungeprüft.GGUF und MLX3 Schritte, ohne TerminalProprietär. Im Beruf kostenlos; nicht als Dienst weiterverkaufbarJa: Gespräche als JSON im Klartext
llama.cppVolle Kontrolle und die breiteste Hardware-Unterstützung, Terminal inklusive.Windows · macOS Apple Silicon · macOS Intel (nur CPU) · Linux · Android, iOS, RISC-V, s390xCUDA (Binärdatei nur für Windows), ROCm, Metal, Vulkan, SYCL, OpenVINO, OpenCL, CPUNur GGUF2 Schritte, im Normalfall ohne KompilierenMITNicht auf dem Server: im Browser (IndexedDB)
MLX (mlx-lm)Maximale native Leistung auf einem Apple-Silicon-Mac, mit Python.macOS Apple Silicon · Linux für das Framework · Windows undokumentiert · macOS Intel neinMetal (vereinheitlichter Speicher), CUDA unter Linux, CPU. Neural Engine: nein.MLX und safetensors. Kein GGUF2 Schritte, pipMITGespräche werden nicht gespeichert
vLLMEin Modell hundert Menschen bereitstellen, nicht Ihnen.Linux · macOS Apple Silicon (experimentell, CPU, selbst bauen) · Windows nur über WSL · macOS Intel: ungeprüftCUDA (erste Klasse), ROCm, CPU. Metal nur über externes Plugin.safetensors und Quantisierungen; GGUF nur über externes Plugin2 Schritte, pip — aber ohne jede OberflächeApache-2.0Werden nicht gespeichert (keine Chat-Oberfläche)

Diese Spalten stammen aus denselben Primärquellen. Jede Angabe trägt ihre Herkunft im Blatt des jeweiligen Programms, samt Zitat und Link.