AccueilModèles

Fiches de modèle

Tous les modèles locaux, mesurés

Chaque fiche de modèle est construite à partir de mesures, pas de sa page marketing : la taille réelle des fichiers publiés, la mémoire de contexte calculée d'après le schéma d'attention qu'il déclare couche par couche, et ce que coûte en tokens le fait de dire la même chose dans quatre langues.

Le catalogue mesuré
Modèles avec fiche18
Plus petit / plus grand1,03 / 433,83 GiB
Tiennent dans 8 Go5 sur 18
Langue la plus chèreDE ×1,62
Date de la mesure2026-08-25
ModèleTailleCompression affichéeCoût en allemandTient dans 8 GoLicence
deepseek-v4-flash127,28 GiBIQ4_XS×1,58nonmit
gemma4-12b6,63 GiBQ4_K_M×1,33nonapache-2.0
gemma4-26b-a4b15,78 GiBQ4_K_M×1,33nonapache-2.0
gemma4-31b17,07 GiBQ4_K_M×1,33nonapache-2.0
gemma4-e2b2,89 GiBQ4_K_M×1,33ouiapache-2.0
gemma4-e4b4,64 GiBQ4_K_M×1,33ouiapache-2.0
glm-5.2433,83 GiBQ4_K_M×1,49nonmit
gpt-oss-120b58,46 GiBQ4_K_M×1,29nonapache-2.0
gpt-oss-20b10,83 GiBQ4_K_M×1,29nonapache-2.0
llama4-scout-17b60,87 GiBQ4_K_M×1,30nonother
mistral-small-24b13,35 GiBQ4_K_M×1,40nonapache-2.0
qwen3-1.7b1,03 GiBQ4_K_M×1,62ouiapache-2.0
qwen3-4b-25072,33 GiBQ4_K_M×1,62ouiapache-2.0
qwen3-8b4,68 GiBQ4_K_M×1,62ouiapache-2.0
qwen3-coder-30b17,28 GiBQ4_K_M×1,62nonapache-2.0
qwen3.6-27b15,66 GiBQ4_K_M×1,31nonapache-2.0
qwen3.6-35b-a3b20,61 GiBQ4_K_M×1,31nonapache-2.0
qwen3.8-27b15,33 GiBQ4_K_M×1,31nonapache-2.0

Les tailles sont celles des fichiers réellement publiés en Q4_K_M, notre plancher de qualité. Lorsque l’auteur ne la publie pas, la ligne bascule vers la compression la plus proche et indique laquelle : une taille à une compression comparée à une autre n’est pas une comparaison.

Ce tableau ne dit pas ce qui tourne sur votre machine. Il dit la taille de chaque modèle. Lesquels tiennent dans votre mémoire — avec le contexte dont votre travail a besoin, et dans votre langue — c'est le Trouveur de modèle qui répond.

Vérifier sur ma machine