Programme
Fünf Programme, die ein Modell auf Ihrem eigenen Rechner ausführen. Diese Tabelle beantwortet, was die Herstellerseiten nicht beantworten: ob sie ungefragt Nutzungsdaten senden, wen sie sonst noch anrufen, auf welcher Adresse sie lauschen und vor allem, ob das jemand von außen überprüfen kann. Alles hier wurde am 25. August 2026 im veröffentlichten Quellcode und in der offiziellen Dokumentation gelesen; nichts stammt aus der Beobachtung des Netzverkehrs.
Die vier Fragen, auf die es ankommt
| Programm | Telemetrie ab Werk | Andere Rufe nach Hause | Auf welcher Adresse es lauscht | Lässt es sich überprüfen? |
|---|---|---|---|---|
| Ollama | Keine Fremd-Analytik, ruft aber nach Hause von uns geprüft | Update-Prüfung stündlich (nicht abschaltbar) und entfernter Katalog alle 4 h (OLLAMA_NO_CLOUD) von uns geprüft | 127.0.0.1:11434, ohne Schlüssel, freizügiges CORS von uns geprüft | Ja — MIT, öffentlicher Code von uns geprüft |
| LM Studio | Erklärt, keine zu haben Herstellerangabe | Update-Prüfung (kein dokumentierter Schalter) und Modellsuche Herstellerangabe | 127.0.0.1:1234, ohne Schlüssel, aber CORS aus und API-Schlüssel verfügbar Herstellerangabe | Nein — geschlossener Code, Reverse Engineering verboten von uns geprüft |
| llama.cpp | Überhaupt keine von uns geprüft | Keine: weder Update-Prüfung noch sonst etwas von uns geprüft | 127.0.0.1:8080, ohne Schlüssel, CORS spiegelt jeden Ursprung von uns geprüft | Ja — MIT, öffentlicher Code von uns geprüft |
| MLX (mlx-lm) | Keine eigene; erbt die der Download-Bibliothek von uns geprüft | Nur der Modell-Download (HF_HUB_DISABLE_TELEMETRY / HF_HUB_OFFLINE) von uns geprüft | 127.0.0.1:8080, ohne Schlüssel, CORS sperrangelweit offen von uns geprüft | Ja — MIT, öffentlicher Code von uns geprüft |
| vLLM | Ja, ab Werk eingeschaltet — Herzschlag alle 10 Min. an stats.vllm.ai von uns geprüft | Modell-Download mit Selbstidentifikation als vLLM gegenüber Hugging Face; lokaler Metrik-Endpunkt von uns geprüft | 0.0.0.0:8000 — alle Schnittstellen, ohne Schlüssel von uns geprüft | Ja — Apache-2.0, öffentlicher Code von uns geprüft |
Jede Zelle dieser vier Spalten sagt, woher wir es wissen: ● von uns an der Primärquelle geprüft, ◐ Herstellerangabe ohne unabhängige Prüfung, ○ konnten wir nicht überprüfen. Lesen Sie die letzte Spalte zuerst: Eines dieser fünf kann niemand außerhalb des Unternehmens überprüfen, und das macht aus seiner ganzen Zeile ein Versprechen statt einer Tatsache. Nichts davon stammt aus der Beobachtung des Netzverkehrs — wir haben den veröffentlichten Quellcode und die offizielle Dokumentation gelesen.
Alles Übrige
| Programm | Was es löst | Wo es läuft | Was es beschleunigt | Formate | Schritte bis zum ersten Token | Lizenz | Was auf Ihrer Festplatte bleibt |
|---|---|---|---|---|---|---|---|
| Ollama | Ein Modell, das in zwei Minuten antwortet, ohne Parameter anzufassen. | Windows · macOS Apple Silicon · macOS Intel (nur CPU) · Linux (ohne Desktop-App) | CUDA, ROCm, Metal, Vulkan (ab Werk an), CPU. Kein NPU. | GGUF und safetensors | 2 Schritte, ohne Kompilieren | MIT | Ja: Gespräche in einer unverschlüsselten SQLite-Datenbank |
| LM Studio | Alles auf dem Bildschirm, ohne Kommandozeile. | Windows (AVX2) · macOS Apple Silicon · macOS Intel nein · Linux (nur AppImage) | CUDA, ROCm, Metal, Vulkan, CPU — laut Quelle von Januar 2025. NPU: ungeprüft. | GGUF und MLX | 3 Schritte, ohne Terminal | Proprietär. Im Beruf kostenlos; nicht als Dienst weiterverkaufbar | Ja: Gespräche als JSON im Klartext |
| llama.cpp | Volle Kontrolle und die breiteste Hardware-Unterstützung, Terminal inklusive. | Windows · macOS Apple Silicon · macOS Intel (nur CPU) · Linux · Android, iOS, RISC-V, s390x | CUDA (Binärdatei nur für Windows), ROCm, Metal, Vulkan, SYCL, OpenVINO, OpenCL, CPU | Nur GGUF | 2 Schritte, im Normalfall ohne Kompilieren | MIT | Nicht auf dem Server: im Browser (IndexedDB) |
| MLX (mlx-lm) | Maximale native Leistung auf einem Apple-Silicon-Mac, mit Python. | macOS Apple Silicon · Linux für das Framework · Windows undokumentiert · macOS Intel nein | Metal (vereinheitlichter Speicher), CUDA unter Linux, CPU. Neural Engine: nein. | MLX und safetensors. Kein GGUF | 2 Schritte, pip | MIT | Gespräche werden nicht gespeichert |
| vLLM | Ein Modell hundert Menschen bereitstellen, nicht Ihnen. | Linux · macOS Apple Silicon (experimentell, CPU, selbst bauen) · Windows nur über WSL · macOS Intel: ungeprüft | CUDA (erste Klasse), ROCm, CPU. Metal nur über externes Plugin. | safetensors und Quantisierungen; GGUF nur über externes Plugin | 2 Schritte, pip — aber ohne jede Oberfläche | Apache-2.0 | Werden nicht gespeichert (keine Chat-Oberfläche) |
Diese Spalten stammen aus denselben Primärquellen. Jede Angabe trägt ihre Herkunft im Blatt des jeweiligen Programms, samt Zitat und Link.