Logiciels
Cinq logiciels pour exécuter un modèle sur votre propre machine. Ce tableau répond à ce que leurs sites ne disent pas : s’ils envoient des données d’usage sans rien demander, qui d’autre ils appellent, sur quelle adresse ils écoutent et, surtout, si quelqu’un d’extérieur peut le vérifier. Tout ici a été lu dans le code publié et la documentation officielle le 25 août 2026 ; rien ne vient de l’observation du trafic réseau.
Les quatre questions qui comptent
| Logiciel | Télémétrie par défaut | Autres appels vers l'extérieur | Sur quelle adresse il écoute | Peut-on l’auditer ? |
|---|---|---|---|---|
| Ollama | Pas d'analytique tierce, mais il appelle l'extérieur vérifié par nous | Mises à jour toutes les heures (impossible à couper) et catalogue distant toutes les 4 h (OLLAMA_NO_CLOUD) vérifié par nous | 127.0.0.1:11434, sans clé, CORS permissif vérifié par nous | Oui — MIT, code public vérifié par nous |
| LM Studio | Déclare ne pas en avoir déclaré par l'éditeur | Vérification des mises à jour (sans interrupteur documenté) et recherche de modèles déclaré par l'éditeur | 127.0.0.1:1234, sans clé, mais CORS désactivé et clés d'API disponibles déclaré par l'éditeur | Non — code fermé, rétro-ingénierie interdite vérifié par nous |
| llama.cpp | Aucune vérifié par nous | Aucune : ni vérification de mises à jour, ni rien d'autre vérifié par nous | 127.0.0.1:8080, sans clé, CORS qui renvoie n'importe quelle origine vérifié par nous | Oui — MIT, code public vérifié par nous |
| MLX (mlx-lm) | Aucune en propre ; hérite de celle de la bibliothèque de téléchargement vérifié par nous | Seulement le téléchargement des modèles (HF_HUB_DISABLE_TELEMETRY / HF_HUB_OFFLINE) vérifié par nous | 127.0.0.1:8080, sans clé, CORS grand ouvert vérifié par nous | Oui — MIT, code public vérifié par nous |
| vLLM | Oui, activée d'usine — battement toutes les 10 min vers stats.vllm.ai vérifié par nous | Téléchargement de modèles en s'identifiant auprès de Hugging Face comme vLLM ; point de métriques local vérifié par nous | 0.0.0.0:8000 — toutes les interfaces, sans clé vérifié par nous | Oui — Apache-2.0, code public vérifié par nous |
Chaque cellule de ces quatre colonnes dit comment nous le savons : ● vérifié par nous à la source primaire, ◐ déclaré par l’éditeur et non vérifié de façon indépendante, ○ nous n’avons pas pu le vérifier. Lisez la dernière colonne en premier : l’un de ces cinq ne peut être audité par personne hors de l’entreprise, ce qui fait passer toute sa ligne du fait à la promesse. Rien de tout cela ne vient de l’observation du trafic réseau : nous avons lu le code publié et la documentation officielle.
Tout le reste
| Logiciel | Ce qu’il résout | Où il fonctionne | Ce qu’il accélère | Formats | Étapes jusqu’au premier token | Licence | Ce qu’il garde sur votre disque |
|---|---|---|---|---|---|---|---|
| Ollama | Un modèle qui répond en deux minutes, sans toucher un paramètre. | Windows · macOS Apple Silicon · macOS Intel (CPU seul) · Linux (sans appli de bureau) | CUDA, ROCm, Metal, Vulkan (activé d'usine), CPU. Pas de NPU. | GGUF et safetensors | 2 étapes, sans compiler | MIT | Oui : conversations dans une base SQLite non chiffrée |
| LM Studio | Tout à l'écran, sans ligne de commande. | Windows (AVX2) · macOS Apple Silicon · macOS Intel non · Linux (AppImage uniquement) | CUDA, ROCm, Metal, Vulkan, CPU — d'après une source de janvier 2025. NPU : non vérifié. | GGUF et MLX | 3 étapes, sans terminal | Propriétaire. Gratuite au travail ; revente comme service interdite | Oui : conversations en JSON en clair |
| llama.cpp | Contrôle total et prise en charge matérielle la plus large, terminal compris. | Windows · macOS Apple Silicon · macOS Intel (CPU seul) · Linux · Android, iOS, RISC-V, s390x | CUDA (binaire Windows seulement), ROCm, Metal, Vulkan, SYCL, OpenVINO, OpenCL, CPU | GGUF uniquement | 2 étapes, sans compiler dans le cas normal | MIT | Pas sur le serveur : dans votre navigateur (IndexedDB) |
| MLX (mlx-lm) | Performance native maximale sur un Mac Apple Silicon, Python compris. | macOS Apple Silicon · Linux pour le framework · Windows non documenté · macOS Intel non | Metal (mémoire unifiée), CUDA sous Linux, CPU. Neural Engine : non. | MLX et safetensors. Pas de GGUF | 2 étapes, pip | MIT | Les conversations ne sont pas enregistrées |
| vLLM | Servir un modèle à cent personnes, pas à vous. | Linux · macOS Apple Silicon (expérimental, CPU, à compiler) · Windows via WSL seulement · macOS Intel : non vérifié | CUDA (première classe), ROCm, CPU. Metal seulement par greffon externe. | safetensors et quantifications ; GGUF seulement par greffon externe | 2 étapes, pip — mais aucune interface | Apache-2.0 | Non conservées (pas d'interface de discussion) |
Ces colonnes proviennent des mêmes sources primaires. Chaque donnée porte sa provenance dans la fiche de son logiciel, citation et lien compris.