Startseite›Modelle›qwen3-coder-30b
qwen3-coder-30b
Architektur Expertenmischung48 SchichtenLizenz apache-2.0Maximaler Kontext 256kVokabular 151.936
Bei Q4_K_M ist das eine Datei von 17,28 GiB, und sie passt auf 5 der 10 getesteten Rechner. Teuer ist nicht die Datei, sondern der Kontext — und derselbe Inhalt kostet auf Deutsch das ×1,62-fache von Englisch.
Modellgröße bei Q4_K_M
Von Local AI Scope gemessen
Kontextspeicher bei 8k Tokens
Von Local AI Scope gemessen
Was Deutsch gegenüber Englisch kostet
Von Local AI Scope gemessen
Größen der veröffentlichten Dateien
Das sind die Größen der tatsächlich vom Autor veröffentlichten Dateien, addiert, wenn das Modell in Teilen ausgeliefert wird. Keine Schätzung aus der Parameterzahl.
| Kompression | Modellgröße |
|---|---|
Q8_0 |
30,25 GiB |
Q6_K |
23,37 GiB |
Q5_K_M |
20,23 GiB |
Q5_K_S |
19,63 GiB |
Q4_K_M |
17,28 GiB |
Q4_K_S |
16,26 GiB |
IQ4_XS |
15,25 GiB |
Q3_K_M |
13,70 GiB |
Kontextspeicher
Berechnet aus dem Aufmerksamkeitsmuster, das dieses Modell Schicht für Schicht angibt, nicht aus der generischen Formel. Deshalb liegt der Wert oft deutlich unter dem anderer Rechner.
- 8k Tokens → 0,75 GiB
- 32k Tokens → 3,00 GiB
- 128k Tokens → 12,00 GiB
Was es in jeder Sprache kostet
Gemessen, indem der Tokenizer dieses Modells über denselben Inhalt in vier Sprachen läuft. Tokens sind das, was man im Kontext, im Speicher und auf der Cloud-Rechnung zahlt.
| Textsorte | EN | ES | FR | DE |
|---|---|---|---|---|
| Code | — | ×1,28 | ×1,47 | ×1,68 |
| Verträge | — | ×1,39 | ×1,42 | ×1,74 |
| Geschäftliche E-Mails | — | ×1,25 | ×1,36 | ×1,46 |
| Support-Tickets | — | ×1,39 | ×1,57 | ×1,54 |
Englisch ist die Referenz: Jede Zahl gibt an, um wie viel mehr Tokens derselbe Inhalt in dieser Sprache kostet. Durchschnitt über das gesamte Korpus: DE ×1,62.
Wo es passt
Passt heißt: Modell, Kontextspeicher und Arbeitsreserve passen beim angegebenen Kontext gemeinsam hinein und lassen dem System seinen Anteil. 5 von den 10 getesteten Rechnern (Q4_K_M, 8k Tokens).
| Rechner | Passt | Freier Speicher | Größter Kontext, der passt |
|---|---|---|---|
| PC mit RTX 4060 8 GB | nein | 7,20 GiB | — |
| PC mit RTX 3060 12 GB | nein | 11,20 GiB | — |
| PC mit RTX 4070 12 GB | nein | 11,20 GiB | — |
| Mac mit M4 und 16 GB Unified Memory | nein | 13,00 GiB | — |
| Büro-Notebook, nur CPU, 16 GB | nein | 13,00 GiB | — |
| Mac mit M4 Pro und 24 GB | ja | 21,00 GiB | 16k |
| Workstation mit RTX 4090 24 GB | ja | 23,20 GiB | 32k |
| Mini-PC mit NPU und 32 GB LPDDR5X | ja | 29,00 GiB | 64k |
| Server mit 2× RTX 3090 (48 GB) | ja | 47,20 GiB | 256k |
| Mac mit M4 Max und 64 GB | ja | 61,00 GiB | 256k |