Ollama
Version en vigueur 0.32.152026-08-19Arbre audité tag v0.32.15 (commit b7871fc0d1d82fe109536efa3e0e8e411c766c75, 2026-08-19)Licence MIT
Pour qui veut un modèle qui répond en deux minutes et n’a aucune intention de toucher au moindre paramètre.
Serveur local de modèles avec installateur de bureau, catalogue maison et une seule commande qui télécharge et exécute. C’est ce qui ressemble le plus à une boîte noire qui marche toute seule.
Étapes jusqu’au premier token
Mesuré par Local AI Scope
Hôtes qu’il contacte d’origine
Déclaré par le fabricant
Licence
Mesuré par Local AI Scope
Comment nous l’avons vérifié
Tout ce que cette fiche affirme sur le réseau vient de la lecture du code publié et de la documentation officielle à la date indiquée, et non de l’observation du trafic. Nous n’avons pas exécuté le programme avec un analyseur de réseau : c’est de l’analyse statique, pas de l’observation. Une capture réelle reste à faire ; le jour où nous l’aurons, ces cellules monteront d’un niveau de preuve. Nous préférons le dire plutôt que de vous laisser croire que nous avons reniflé les paquets.
Ce qui sort de votre machine
Les quatre questions auxquelles un logiciel local doit répondre avant de mériter vos documents : ce qu’il envoie de lui-même, qui d’autre il appelle, sur quelle adresse il écoute, et si vous pouvez le vérifier vous-même.
Télémétrie par défaut
Aucune analytique tierce — mais il n’est pas muet pour autant. Vérifié par nous à la source primaire
Il n’y a pas une seule bibliothèque d’analytique dans tout l’arbre publié : ni telemetry, ni analytics, ni posthog, mixpanel, sentry ou datadog en dehors des fichiers de test. C’est un point en sa faveur et c’est vérifiable. Ce qu’il y a, en revanche, ce sont des appels automatiques vers ollama.com, ce qui est autre chose et fait l’objet de la section suivante.
«We may collect limited device and usage metadata (such as app version and request counts).»
Comment le désactiver: Il n’existe pas d’interrupteur de télémétrie : aucune des 57 variables OLLAMA_* de l’arbre n’en est un, parce qu’il n’y a pas de SDK d’analytique à éteindre. Le levier qui existe, OLLAMA_NO_CLOUD=1, coupe les fonctions cloud et le catalogue distant ; pas la vérification des mises à jour.
Source · consulté le 2026-08-25
Autres appels vers l’extérieur
| Quoi | Vers où | Quand | Peut-on l’éviter | Preuve |
|---|---|---|---|---|
| Catalogue et téléchargement des modèles | registry.ollama.ai |
Lors d’un pull ou d’un run d’un modèle absent du disque. | Non : c’est la fonction | vérifié par nous |
| Vérification des mises à jour, signée avec une clé stockée sur votre machine | ollama.com/api/update |
Toutes les heures tant que l’application de bureau est ouverte. Sur macOS, elle emporte en plus un identifiant persistant de l’appareil. | Non. Voir plus bas | vérifié par nous |
| Catalogue distant de modèles recommandés | ollama.com/api/experimental/model-recommendations |
Toutes les 4 heures, lancé par `ollama serve` lui-même : sans application de bureau et sans compte. | Oui : OLLAMA_NO_CLOUD=1 | vérifié par nous |
| Inférence dans le cloud et recherche web | ollama.com |
Seulement avec les modèles à suffixe :cloud ou la recherche web, et seulement après `ollama signin`. | Oui : OLLAMA_NO_CLOUD=1 | déclaré par l’éditeur |
«The original macOS app used to use the device ID to check for updates so include it if present. […] Auto-update disabled – don’t download, just log.»
Source · consulté le 2026-08-25
Sur quelle adresse il écoute
| Réglage | D’origine |
|---|---|
| Écoute sur | 127.0.0.1:11434 |
| Authentification par défaut | aucune |
| CORS par défaut | Permissif : localhost sur n’importe quel port, plus app://, file://, tauri://, vscode-webview://, vscode-file:// et extensions de navigateur |
Il n’écoute que sur localhost, ce qui est raisonnable. Le bémol, c’est le CORS : sans rien configurer, il accepte les requêtes de n’importe quelle page servie sur localhost, sur n’importe quel port, plus app://, file://, tauri://, vscode-webview://, vscode-file:// et les extensions de navigateur. Et l’API locale n’a aucune authentification : OLLAMA_AUTH ne protège pas le serveur, elle fait seulement signer le client. Vérifié par nous à la source primaire
Source · consulté le 2026-08-25
Peut-on l’auditer ?
Oui. Le code est public et sous MIT, donc tout ce que dit cette fiche sur le réseau a été vérifié en le lisant, pas en le croyant. C’est la différence entre un fait et une promesse, et c’est ce qui rend cette ligne du tableau crédible. Vérifié par nous à la source primaire
Source · consulté le 2026-08-25
Politique de confidentialité
Ollama Inc., politique de mars 2026. Elle dit que le programme s’exécute localement et qu’ils ne voient pas vos prompts, et en même temps qu’ils peuvent collecter des métadonnées limitées d’appareil et d’usage, dont le nombre de requêtes — ce qui suppose de compter par installation. déclaré par l’éditeur Source
Ce qu’il exécute, et où
Plateformes, accélérateurs et formats de modèle : les trois murs rencontrés dès le premier soir, et ceux que personne n’écrit avant de s’y être heurté.
Où il fonctionne
| Plateforme | Prise en charge | Preuve |
|---|---|---|
| Windows | Oui : Windows 10 22H2 ou plus récent, x64 et ARM64. L’installation ne demande pas de droits d’administrateur. | déclaré par l’éditeur |
| macOS Apple Silicon | Oui : macOS Sonoma (14) ou plus récent, en utilisant le CPU et le GPU. | déclaré par l’éditeur |
| macOS Intel | Oui, mais en CPU seulement : le binaire macOS est universel, il démarre donc, mais ne touche jamais au GPU. | vérifié par nous |
| Linux | Oui : archives amd64 et arm64, paquet ROCm séparé pour les cartes AMD et paquets JetPack pour Jetson. Pas d’application de bureau sous Linux. | vérifié par nous |
Ce qu’il accélère
| Moteur | État | Preuve |
|---|---|---|
| CUDA | Oui : NVIDIA avec capacité de calcul 5.0 ou plus et pilote 550+. De 5.0 à 6.2, pilote 570+ exigé. | déclaré par l’éditeur |
| ROCm | Oui, sous Windows aussi : exige la pile de pilotes ROCm v7 / HIP7. | déclaré par l’éditeur |
| Metal | Oui sur Apple Silicon. Pas de Metal sur Mac Intel. | déclaré par l’éditeur |
| Vulkan | Oui, et activé par défaut sous Windows et Linux. Se désactive avec OLLAMA_VULKAN=0. | vérifié par nous |
| CPU | Oui, avec des bibliothèques par niveau de vectorisation (cpu_avx2, cpu_avx, cpu). | déclaré par l’éditeur |
| NPU | Non. Ni NPU Ryzen AI, ni Neural Engine d’Apple, ni QNN, DirectML ou OpenVINO. | vérifié par nous |
Formats de modèle qu’il exécute
GGUF et safetensors. Les modèles du catalogue arrivent dans son propre empaquetage par couches ; pour les vôtres, il accepte un dossier de safetensors ou un fichier .gguf. déclaré par l’éditeur
Source · consulté le 2026-08-25
L’installer et vivre avec
Combien d’étapes jusqu’au premier token, ce qu’il laisse sur votre disque, sous quelle licence et à quel rythme il change sous vos pieds.
Étapes jusqu’au premier token
2 étapes. L’installer et lancer `ollama run <modèle>` : une seule commande télécharge le modèle et répond. vérifié par nous
Ce qu’il écrit sur votre disque
| Quoi | Où | Preuve |
|---|---|---|
| Modèles | ~/.ollama/models — configurable avec OLLAMA_MODELS ; sous Linux en service, /usr/share/ollama/.ollama/models |
vérifié par nous |
| La clé qui identifie votre installation auprès d’ollama.com | ~/.ollama/id_ed25519 + .pub |
vérifié par nous |
| Historique des conversations de l’application de bureau : une base SQLite non chiffrée | macOS ~/Library/Application Support/Ollama/db.sqlite · Windows %LOCALAPPDATA%Ollamadb.sqlite · Linux ~/.ollama/db.sqlite |
vérifié par nous |
| Historique de la ligne de commande | ~/.ollama/history — se coupe avec OLLAMA_NOHISTORY |
vérifié par nous |
| Catalogue distant mis en cache | ~/.ollama/cache/model-recommendations.json |
vérifié par nous |
| Journaux et configuration | ~/.ollama/logs/{app,server,upgrade}.log · ~/.ollama/config.json · ~/.ollama/server.json |
déclaré par l’éditeur |
Licence
MIT. Libre d’utilisation, de modification et de redistribution, y compris au travail. vérifié par nous
Source · consulté le 2026-08-25
Version et rythme de publication
Très rapide : deux ou trois versions stables par semaine par à-coups, et un saut de version mineure environ une fois par mois. 104 publications en douze mois, dont 99 stables. vérifié par nous
Source · consulté le 2026-08-25
À savoir avant de l’installer
- Local ne veut pas dire muet. Le serveur nu — sans application de bureau et sans compte — appelle ollama.com toutes les 4 heures pour son catalogue distant. Celui-là se coupe avec OLLAMA_NO_CLOUD=1.
- L’application de bureau vérifie les mises à jour toutes les heures, la requête est signée avec une clé stockée sur votre machine, et cette vérification ne peut pas être désactivée. Le réglage de mise à jour automatique n’empêche que le téléchargement : la boucle appelle d’abord et lit le réglage ensuite.
- Le serveur n’écoute que sur 127.0.0.1, mais il accepte les requêtes de n’importe quelle page servie sur localhost, de pages ouvertes comme fichiers et d’extensions de navigateur. N’importe quel site que vous visitez et qui ouvre une connexion vers localhost peut parler à votre modèle.
- L’API locale n’a aucune authentification. OLLAMA_AUTH ne protège pas le serveur : elle fait seulement signer le client.
- Les modèles à suffixe :cloud ne s’exécutent pas sur votre machine : ils partent vers les serveurs d’Ollama. Même ligne de commande, confidentialité totalement différente.