Logiciels

Cinq logiciels pour exécuter un modèle sur votre propre machine. Ce tableau répond à ce que leurs sites ne disent pas : s’ils envoient des données d’usage sans rien demander, qui d’autre ils appellent, sur quelle adresse ils écoutent et, surtout, si quelqu’un d’extérieur peut le vérifier. Tout ici a été lu dans le code publié et la documentation officielle le 25 août 2026 ; rien ne vient de l’observation du trafic réseau.

Les quatre questions qui comptent

LogicielTélémétrie par défautAutres appels vers l'extérieurSur quelle adresse il écoutePeut-on l’auditer ?
OllamaPas d'analytique tierce, mais il appelle l'extérieur
vérifié par nous
Mises à jour toutes les heures (impossible à couper) et catalogue distant toutes les 4 h (OLLAMA_NO_CLOUD)
vérifié par nous
127.0.0.1:11434, sans clé, CORS permissif
vérifié par nous
Oui — MIT, code public
vérifié par nous
LM StudioDéclare ne pas en avoir
déclaré par l'éditeur
Vérification des mises à jour (sans interrupteur documenté) et recherche de modèles
déclaré par l'éditeur
127.0.0.1:1234, sans clé, mais CORS désactivé et clés d'API disponibles
déclaré par l'éditeur
Non — code fermé, rétro-ingénierie interdite
vérifié par nous
llama.cppAucune
vérifié par nous
Aucune : ni vérification de mises à jour, ni rien d'autre
vérifié par nous
127.0.0.1:8080, sans clé, CORS qui renvoie n'importe quelle origine
vérifié par nous
Oui — MIT, code public
vérifié par nous
MLX (mlx-lm)Aucune en propre ; hérite de celle de la bibliothèque de téléchargement
vérifié par nous
Seulement le téléchargement des modèles (HF_HUB_DISABLE_TELEMETRY / HF_HUB_OFFLINE)
vérifié par nous
127.0.0.1:8080, sans clé, CORS grand ouvert
vérifié par nous
Oui — MIT, code public
vérifié par nous
vLLMOui, activée d'usine — battement toutes les 10 min vers stats.vllm.ai
vérifié par nous
Téléchargement de modèles en s'identifiant auprès de Hugging Face comme vLLM ; point de métriques local
vérifié par nous
0.0.0.0:8000 — toutes les interfaces, sans clé
vérifié par nous
Oui — Apache-2.0, code public
vérifié par nous

Chaque cellule de ces quatre colonnes dit comment nous le savons : ● vérifié par nous à la source primaire, ◐ déclaré par l’éditeur et non vérifié de façon indépendante, ○ nous n’avons pas pu le vérifier. Lisez la dernière colonne en premier : l’un de ces cinq ne peut être audité par personne hors de l’entreprise, ce qui fait passer toute sa ligne du fait à la promesse. Rien de tout cela ne vient de l’observation du trafic réseau : nous avons lu le code publié et la documentation officielle.

Tout le reste

LogicielCe qu’il résoutOù il fonctionneCe qu’il accélèreFormatsÉtapes jusqu’au premier tokenLicenceCe qu’il garde sur votre disque
OllamaUn modèle qui répond en deux minutes, sans toucher un paramètre.Windows · macOS Apple Silicon · macOS Intel (CPU seul) · Linux (sans appli de bureau)CUDA, ROCm, Metal, Vulkan (activé d'usine), CPU. Pas de NPU.GGUF et safetensors2 étapes, sans compilerMITOui : conversations dans une base SQLite non chiffrée
LM StudioTout à l'écran, sans ligne de commande.Windows (AVX2) · macOS Apple Silicon · macOS Intel non · Linux (AppImage uniquement)CUDA, ROCm, Metal, Vulkan, CPU — d'après une source de janvier 2025. NPU : non vérifié.GGUF et MLX3 étapes, sans terminalPropriétaire. Gratuite au travail ; revente comme service interditeOui : conversations en JSON en clair
llama.cppContrôle total et prise en charge matérielle la plus large, terminal compris.Windows · macOS Apple Silicon · macOS Intel (CPU seul) · Linux · Android, iOS, RISC-V, s390xCUDA (binaire Windows seulement), ROCm, Metal, Vulkan, SYCL, OpenVINO, OpenCL, CPUGGUF uniquement2 étapes, sans compiler dans le cas normalMITPas sur le serveur : dans votre navigateur (IndexedDB)
MLX (mlx-lm)Performance native maximale sur un Mac Apple Silicon, Python compris.macOS Apple Silicon · Linux pour le framework · Windows non documenté · macOS Intel nonMetal (mémoire unifiée), CUDA sous Linux, CPU. Neural Engine : non.MLX et safetensors. Pas de GGUF2 étapes, pipMITLes conversations ne sont pas enregistrées
vLLMServir un modèle à cent personnes, pas à vous.Linux · macOS Apple Silicon (expérimental, CPU, à compiler) · Windows via WSL seulement · macOS Intel : non vérifiéCUDA (première classe), ROCm, CPU. Metal seulement par greffon externe.safetensors et quantifications ; GGUF seulement par greffon externe2 étapes, pip — mais aucune interfaceApache-2.0Non conservées (pas d'interface de discussion)

Ces colonnes proviennent des mêmes sources primaires. Chaque donnée porte sa provenance dans la fiche de son logiciel, citation et lien compris.