Accueil›Guides
Des guides qui répondent par une mesure
Chaque guide part d’un chiffre mesuré sur ce site qui contredit une idée très répandue. Le tableau dit ce que chacun tranche et le chiffre qu’il apporte, pour savoir lequel vaut votre temps avant de l’ouvrir.
| Guide | Ce qu’il tranche | Le chiffre mesuré |
|---|---|---|
| ChoisirQuelle carte graphique pour une IA en local : ce qui tient vraiment, en français | La langue change le nombre de modèles qui tiennent sur la même carte : sur une RTX 4060 de 8 Go avec un contrat de 12 000 mots, 4 en anglais et 3 en français. | 4 → 3 |
Tous les chiffres de ce tableau sont mesurés par Local AI Scope sur les fichiers réellement publiés et un corpus parallèle, et chaque guide porte la date de sa mesure. Aucun n’est une affirmation de fabricant.
La même méthode, appliquée à une autre langue
Ce ne sont pas des traductions les uns des autres : chacun compte ce que coûte sa propre langue sur les mêmes 18 modèles. Ils sont ici parce que la réponse se trouve le plus souvent dans la langue dans laquelle vous travaillez vraiment.
| Guide | Ce qu’il tranche | Le chiffre mesuré |
|---|---|---|
| Auswahl · DeutschPC für KI-Anwendungen: was auf Deutsch wirklich hineinpasst | Die Sprache ändert, wie viele Modelle auf dieselbe Karte passen: auf einer 12-GB-Karte mit einem Vertrag von 12.000 Wörtern 6 auf Englisch und 3 auf Deutsch. | 6 → 3 |
| Elegir · EspañolQué PC necesitas para IA local: lo que cabe de verdad, en español | El idioma cambia cuántos modelos caben en la misma tarjeta: en una RTX 4060 de 8 GB con un contrato de 12.000 palabras caben 4 en inglés y 3 en español. | 4 → 3 |
| Choose · EnglishOn German code, qwen3-coder-30b is tied last of the 18 models we measured | A coding model picked on English benchmarks can be the most expensive one on a German codebase: qwen3-coder-30b needs 353 tokens where English needs 210. | 353 vs 210 |
| Privacy · EnglishLLM token calculator: what the same text costs in four languages | What a language costs depends on the model, not only on the language: the same document is ×1.62 tokens in German on qwen3-8b and ×1.29 on gpt-oss-20b. | ×1.62 |
| Choose · EnglishLLM VRAM calculator: what really fits, counted layer by layer | The generic VRAM formula treats every layer as full attention. On gemma4-12b at 32k it claims 12.00 GiB of cache where the real figure is 2.31 GiB. | ×5.2 |
Un guide dit ce qui se passe en général. Ce qui tient sur votre machine — avec le contexte dont votre travail a besoin, et dans votre langue — c’est le Trouveur de modèle qui répond.
Vérifier sur ma machine