gemma4-e2b
Arquitectura denso35 CapasLicencia apache-2.0Contexto máximo 128kVocabulario 262.144
En Q4_K_M es un fichero de 2,89 GiB y entra en 10 de los 10 equipos que medimos. Lo que cuesta ejecutarlo no es el fichero: es el contexto — y el mismo contenido en alemán cuesta ×1,33 lo que cuesta en inglés.
Tamaño del modelo en Q4_K_M
Medido por Local AI Scope
Memoria de contexto a 8k tokens
Medido por Local AI Scope
Lo que cuesta el alemán frente al inglés
Medido por Local AI Scope
Tamaños de los ficheros publicados
Son los tamaños de los ficheros que publica su autor, sumados cuando el modelo viene partido en trozos. No es una estimación a partir del número de parámetros.
| Compresión | Tamaño del modelo |
|---|---|
Q8_0 |
4,70 GiB |
Q6_K |
4,19 GiB |
Q5_K_M |
3,13 GiB |
Q5_K_S |
3,09 GiB |
Q4_K_M |
2,89 GiB |
Q4_K_S |
2,83 GiB |
IQ4_XS |
2,78 GiB |
Q3_K_M |
2,36 GiB |
Memoria de contexto
Calculada con el patrón de atención que este modelo declara capa a capa, no con la fórmula genérica. Por eso la cifra suele ser bastante menor que la que dan otras calculadoras.
- 8k tokens → 0,07 GiB
- 32k tokens → 0,23 GiB
- 128k tokens → 0,89 GiB
Lo que cuesta en cada idioma
Medido ejecutando el tokenizador de este modelo sobre el mismo contenido en cuatro idiomas. Los tokens son lo que se paga en contexto, en memoria y en la factura de la nube.
| Tipo de texto | EN | ES | FR | DE |
|---|---|---|---|---|
| Código | — | ×1,16 | ×1,25 | ×1,39 |
| Contratos | — | ×1,15 | ×1,22 | ×1,36 |
| Correo de empresa | — | ×1,11 | ×1,21 | ×1,21 |
| Tickets de soporte | — | ×1,20 | ×1,40 | ×1,32 |
El inglés es la referencia: cada cifra es cuántas veces más tokens cuesta el mismo contenido en ese idioma. Media sobre todo el corpus: DE ×1,33.
Dónde cabe
Que quepa significa que caben el modelo, su memoria de contexto y el margen de trabajo al contexto indicado, dejándole al sistema lo suyo. 10 de los 10 equipos probados (Q4_K_M, 8k tokens).
| Equipo | Cabe | Memoria libre | Mayor contexto que cabe |
|---|---|---|---|
| PC con RTX 4060 8 GB | sí | 7,20 GiB | 128k |
| PC con RTX 3060 12 GB | sí | 11,20 GiB | 128k |
| PC con RTX 4070 12 GB | sí | 11,20 GiB | 128k |
| Mac con M4 y 16 GB unificados | sí | 13,00 GiB | 128k |
| Portátil de oficina, solo CPU y 16 GB | sí | 13,00 GiB | 128k |
| Mac con M4 Pro y 24 GB | sí | 21,00 GiB | 128k |
| Estación con RTX 4090 24 GB | sí | 23,20 GiB | 128k |
| Mini-PC con NPU y 32 GB LPDDR5X | sí | 29,00 GiB | 128k |
| Servidor con 2× RTX 3090 (48 GB) | sí | 47,20 GiB | 128k |
| Mac con M4 Max y 64 GB | sí | 61,00 GiB | 128k |