Ollama
Versión vigente 0.32.152026-08-19Árbol auditado tag v0.32.15 (commit b7871fc0d1d82fe109536efa3e0e8e411c766c75, 2026-08-19)Licencia MIT
Para quien quiere un modelo respondiendo en dos minutos y no piensa tocar ni un parámetro.
Servidor local de modelos con instalador de escritorio, catálogo propio y un solo comando que descarga y ejecuta. Es lo más parecido que hay a una caja negra que funciona sola.
Pasos hasta el primer token
Medido por Local AI Scope
Sitios a los que llama de fábrica
Declarado por el fabricante
Licencia
Medido por Local AI Scope
Cómo lo hemos comprobado
Todo lo que esta ficha dice sobre la red sale de leer el código publicado y la documentación oficial en la fecha indicada, no de observar el tráfico. No hemos ejecutado el programa con un analizador de red delante, así que esto es análisis estático, no observación. Una captura real sigue pendiente; el día que la haya, estas celdas suben un nivel de evidencia. Preferimos decirlo a que des por hecho que hemos mirado los paquetes.
Qué sale de tu equipo
Las cuatro preguntas que un programa local tiene que contestar antes de merecer tus documentos: qué manda por su cuenta, a quién más llama, en qué dirección escucha y si puedes comprobarlo tú mismo.
Telemetría de fábrica
Sin analítica de terceros, pero tampoco es mudo. Verificado por nosotros en la fuente primaria
No hay ni una sola librería de analítica en todo el árbol publicado: nada de telemetry, analytics, posthog, mixpanel, sentry ni datadog fuera de los ficheros de prueba. Es un punto a su favor y es comprobable. Lo que sí hay son llamadas automáticas a ollama.com, que es otra cosa y va en la sección siguiente.
«We may collect limited device and usage metadata (such as app version and request counts).»
Cómo se apaga: No hay interruptor de telemetría: ninguna de las 57 variables OLLAMA_* del árbol lo es, porque no hay SDK de analítica que apagar. La palanca que sí existe, OLLAMA_NO_CLOUD=1, corta las funciones de nube y el catálogo remoto; la comprobación de actualizaciones no.
Fuente · consultado el 2026-08-25
Otras llamadas a casa
| Qué | A dónde | Cuándo | Se puede evitar | Evidencia |
|---|---|---|---|---|
| Catálogo y descarga de modelos | registry.ollama.ai |
Al hacer pull o run de un modelo que no está en disco. | No: es la función | verificado por nosotros |
| Comprobación de actualizaciones, firmada con una clave guardada en tu equipo | ollama.com/api/update |
Cada hora mientras la aplicación de escritorio esté abierta. En macOS lleva además un identificador persistente del dispositivo. | No. Ver abajo | verificado por nosotros |
| Catálogo remoto de modelos recomendados | ollama.com/api/experimental/model-recommendations |
Cada 4 horas, arrancado por el propio `ollama serve`: sin aplicación de escritorio y sin cuenta. | Sí: OLLAMA_NO_CLOUD=1 | verificado por nosotros |
| Inferencia en la nube y búsqueda web | ollama.com |
Solo con modelos de sufijo :cloud o al usar la búsqueda web, y solo tras `ollama signin`. | Sí: OLLAMA_NO_CLOUD=1 | declarado por el fabricante |
«The original macOS app used to use the device ID to check for updates so include it if present. […] Auto-update disabled – don’t download, just log.»
Fuente · consultado el 2026-08-25
En qué dirección escucha
| Ajuste | De fábrica |
|---|---|
| Escucha en | 127.0.0.1:11434 |
| Autenticación de fábrica | ninguna |
| CORS de fábrica | Permisivo: localhost en cualquier puerto, más app://, file://, tauri://, vscode-webview://, vscode-file:// y extensiones de navegador |
Escucha solo en localhost, que es lo sensato. El fleco es el CORS: sin configurar nada acepta peticiones de cualquier página servida en localhost en cualquier puerto, más app://, file://, tauri://, vscode-webview://, vscode-file:// y extensiones de navegador. Y la API local no tiene autenticación de ningún tipo: OLLAMA_AUTH no protege el servidor, solo hace que el cliente firme. Verificado por nosotros en la fuente primaria
Fuente · consultado el 2026-08-25
¿Se puede auditar?
Sí. El código es público y MIT, así que todo lo que dice esta ficha sobre la red se ha comprobado leyéndolo, no creyéndolo. Esa es la diferencia entre un hecho y una promesa, y es lo que hace que esta fila de la tabla se pueda creer. Verificado por nosotros en la fuente primaria
Fuente · consultado el 2026-08-25
Política de privacidad
Ollama Inc., política de marzo de 2026. Dice que el programa se ejecuta localmente y que no ven tus prompts, y a la vez que pueden recoger metadatos limitados de dispositivo y uso, entre ellos el número de peticiones, lo que implica contar por instalación. declarado por el fabricante Fuente
Qué ejecuta y dónde
Plataformas, aceleradores y formatos de modelo: los tres muros con los que se choca la primera noche, y los que nadie escribe hasta haberse chocado.
Dónde funciona
| Plataforma | Soporte | Evidencia |
|---|---|---|
| Windows | Sí: Windows 10 22H2 o superior, x64 y ARM64. Instalarlo no pide permisos de administrador. | declarado por el fabricante |
| macOS Apple Silicon | Sí: macOS Sonoma (14) o superior, usando CPU y GPU. | declarado por el fabricante |
| macOS Intel | Sí, pero solo por CPU: el binario de macOS es universal, así que arranca, pero nunca toca la GPU. | verificado por nosotros |
| Linux | Sí: tarball para amd64 y arm64, paquete ROCm aparte para gráficas AMD y paquetes JetPack para Jetson. En Linux no hay aplicación de escritorio. | verificado por nosotros |
Qué acelera
| Motor | Estado | Evidencia |
|---|---|---|
| CUDA | Sí: NVIDIA con capacidad de cómputo 5.0 o superior y driver 550+. De 5.0 a 6.2 exigen driver 570+. | declarado por el fabricante |
| ROCm | Sí, también en Windows: exige el stack de driver ROCm v7 / HIP7. | declarado por el fabricante |
| Metal | Sí en Apple Silicon. En Mac Intel no hay Metal. | declarado por el fabricante |
| Vulkan | Sí, y viene activado por defecto en Windows y Linux. Se apaga con OLLAMA_VULKAN=0. | verificado por nosotros |
| CPU | Sí, con librerías por nivel de vectorización (cpu_avx2, cpu_avx, cpu). | declarado por el fabricante |
| NPU | No. Ni NPU de Ryzen AI, ni Neural Engine de Apple, ni QNN, DirectML u OpenVINO. | verificado por nosotros |
Formatos de modelo que ejecuta
GGUF y safetensors. Los modelos del catálogo vienen en su propio empaquetado por capas; para meter los tuyos acepta un directorio de safetensors o un fichero .gguf. declarado por el fabricante
Fuente · consultado el 2026-08-25
Instalarlo y convivir con él
Cuántos pasos hasta el primer token, qué deja en tu disco, bajo qué licencia y a qué ritmo cambia por debajo.
Pasos hasta el primer token
2 pasos. Instalarlo y ejecutar `ollama run <modelo>`: un solo comando descarga el modelo y responde. verificado por nosotros
Qué escribe en tu disco
| Qué | Dónde | Evidencia |
|---|---|---|
| Modelos | ~/.ollama/models — configurable con OLLAMA_MODELS; en Linux como servicio, /usr/share/ollama/.ollama/models |
verificado por nosotros |
| La clave que identifica tu instalación frente a ollama.com | ~/.ollama/id_ed25519 + .pub |
verificado por nosotros |
| Historial de conversaciones de la aplicación de escritorio: una base SQLite sin cifrar | macOS ~/Library/Application Support/Ollama/db.sqlite · Windows %LOCALAPPDATA%Ollamadb.sqlite · Linux ~/.ollama/db.sqlite |
verificado por nosotros |
| Historial de la línea de comandos | ~/.ollama/history — se apaga con OLLAMA_NOHISTORY |
verificado por nosotros |
| Catálogo remoto cacheado | ~/.ollama/cache/model-recommendations.json |
verificado por nosotros |
| Registros y configuración | ~/.ollama/logs/{app,server,upgrade}.log · ~/.ollama/config.json · ~/.ollama/server.json |
declarado por el fabricante |
Licencia
MIT. Libre de usar, modificar y redistribuir, también en el trabajo. verificado por nosotros
Fuente · consultado el 2026-08-25
Versión y ritmo de publicación
Muy rápida: dos o tres versiones estables por semana en rachas y un salto de versión menor aproximadamente al mes. 104 publicaciones en doce meses, 99 de ellas estables. verificado por nosotros
Fuente · consultado el 2026-08-25
Lo que conviene saber antes de instalarlo
- Local no significa mudo. El servidor pelado —sin aplicación de escritorio y sin cuenta— llama a ollama.com cada 4 horas a por su catálogo remoto. Esa sí se corta con OLLAMA_NO_CLOUD=1.
- La aplicación de escritorio comprueba actualizaciones cada hora, la petición va firmada con una clave guardada en tu equipo, y esa comprobación no se puede desactivar. El ajuste de auto-actualización solo evita la descarga: el bucle llama primero y mira el ajuste después.
- El servidor escucha solo en 127.0.0.1, pero acepta peticiones de cualquier página servida en localhost, de páginas abiertas como fichero y de extensiones de navegador. Cualquier web que visites y abra una conexión a localhost puede hablar con tu modelo.
- La API local no tiene autenticación de ninguna clase. OLLAMA_AUTH no protege el servidor: solo hace que el cliente firme.
- Los modelos con sufijo :cloud no se ejecutan en tu equipo: se envían a los servidores de Ollama. Misma línea de comandos, privacidad completamente distinta.