Accueil›Matériel›Mac Studio avec M5 Max et 128 Go unifiés

Fiche de machine

Mac Studio avec M5 Max et 128 Go unifiés

Puce Apple128 GiB614 GB/s18,4 TFLOPS

Mac Studio
Mac Studio Photo : Apple
Mac Studio avec LM Studio à l’écran
Mac Studio avec LM Studio à l’écran Photo : Apple
Puces Apple M5 Max et M5 Ultra
Puces Apple M5 Max et M5 Ultra Image : Apple
Mac Studio avec Draw Things
Mac Studio avec Draw Things Photo : Apple

Voir 3 vidéos

Cette machine laisse 125,00 Gio au modèle une fois que le système a pris sa part, et elle accepte 18 des 20 modèles que nous mesurons à la compression de référence. Ce qui décide de sa vitesse de réponse n’est pas la puce : ce sont les 614 GB/s de bande passante mémoire.

En un coup d’œilDonnées machines · 2026-10-01
Reste pour le modèle125,00 GiB
Bande passante614 GB/s
Modèles qui tiennent18 / 20
Plus gros modèle acceptéqwen3.8-flash-next
125,00 GiB

Reste pour le modèle

Estimation maison

614 GB/s

Bande passante mémoire

Déclaré par le fabricant

18 / 20

Modèles qui tiennent

Mesuré par Local AI Scope

Vidéos

Vidéos : Mac Studio avec M5 Max et 128 Go unifiés 3

Les images officielles et les meilleures démonstrations que nous avons trouvées. Appuyez et la vidéo s’ouvre ici.

Les vidéos sont sur YouTube et rien ne se charge depuis YouTube tant que vous n’appuyez pas (mode sans cookies). La miniature est servie par nous.

Mémoire

La mémoire réellement utilisable

La mémoire unifiée est partagée avec le système d’exploitation et tout ce que vous avez ouvert. La réserve indiquée ici est volontairement prudente ; vous pouvez la modifier dans l’outil.

Comment la mémoire annoncée devient de la mémoire utilisable
Mémoire Gio
Mémoire de la machine 128
Réservée au système −3,00
Reste pour le modèle 125,00
Ce dont Mac Studio avec M5 Max et 128 Go unifiés dispose vraiment pour un modèleBarre horizontale des 128 Gio de Mac Studio avec M5 Max et 128 Go unifiés, répartis en 3,0 Gio pour le système, 87,2 Gio pour le modèle qwen3.8-flash-next, 0,9 Gio pour le contexte et 36,8 Gio libres.0128 GioSystème: 3,0 GioSystème 3,0Modèle: 87,2 GioModèle87,2Contexte (8 192): 0,9 GioContexte (8 192) 0,9Marge: 36,8 GioMarge36,8
Sur les 128 Gio de la machine, 3,0 Gio n’arrivent jamais au modèle. La barre montre qwen3.8-flash-next en IQ4_XS, le plus grand des 20 modèles du jeu de données qui tient encore avec un contexte de 8 192 jetons, et le cache KV qu’exige ce contexte — calculé couche par couche, pas avec la règle de trois habituelle.
Vitesse

Bande passante mémoire

Ce sont deux limites différentes, et on les confond sans cesse. Pendant que le modèle écrit sa réponse, c’est la bande passante qui commande : chaque token oblige à relire tous les poids, si bien que les tokens par seconde valent à peu près la bande passante divisée par la taille du modèle. Pendant que le modèle lit votre document, c’est le calcul qui commande : l’entrée est traitée d’un seul coup. D’où un portable sans GPU qui met des minutes avant le premier mot puis écrit à un rythme acceptable.

614 GB/s — Déclaré par le fabricant · vérifié sur la page du fabricant le 2026-09-18 (Source).

Les 614 Go/s sont ceux de la variante à GPU 40 cœurs du M5 Max, la seule vendue avec 128 Go. La configuration de série est une autre puce : 36 Go, GPU 32 cœurs et 460 Go/s. L’annonce d’Apple ne dit que « jusqu’à » : le chiffre qui compte dépend donc de laquelle des deux on achète.

Calcul: 18,4 TFLOPS (estimation pour cette classe de machine) — Estimé · le fabricant ne publie ce chiffre nulle part ; le nôtre est une estimation prudente, pas une spécification. Les chiffres de cette ligne ne proviennent pas tous de la même mesure selon la machine, car chaque fabricant en publie une différente. Comparez-les d’une machine à l’autre en le sachant.

Compatibilité

Quels modèles tiennent ici, et lesquels non

Tenir signifie que trois choses tiennent à la fois dans la mémoire restante : le fichier du modèle, sa mémoire de contexte et la marge de travail du runtime. La mémoire de contexte est calculée à partir du schéma d’attention que chaque modèle déclare, couche par couche, et non de la formule générique : c’est pourquoi des modèles que d’autres calculateurs jugent impossibles tiennent ici.

Chaque modèle mesuré face à cette machine : taille, s’il tient à chaque contexte et le plus grand contexte qu’il y tient
Modèle Compression affichée Taille du modèle 8k 32k 128k Plus grand contexte qui tient
qwen3-1.7b Q4_K_M 1,03 GiB oui oui — 32k
qwen3-4b-2507 Q4_K_M 2,33 GiB oui oui oui 256k
gemma4-e2b Q4_K_M 2,89 GiB oui oui oui 128k
gemma4-e4b Q4_K_M 4,63 GiB oui oui oui 128k
qwen3-8b Q4_K_M 4,68 GiB oui oui — 32k
granite-4.2-8b Q4_K_M 4,98 GiB oui oui oui 128k
gemma4-12b Q4_K_M 6,63 GiB oui oui oui 256k
gpt-oss-20b Q4_K_M 10,83 GiB oui oui oui 128k
mistral-small-24b Q4_K_M 13,35 GiB oui oui oui 128k
qwen3.8-27b Q4_K_M 15,33 GiB oui oui oui 256k
qwen3.6-27b Q4_K_M 15,66 GiB oui oui oui 256k
gemma4-26b-a4b Q4_K_M 15,78 GiB oui oui oui 256k
gemma4-31b Q4_K_M 17,07 GiB oui oui oui 256k
qwen3-coder-30b Q4_K_M 17,28 GiB oui oui oui 256k
qwen3.6-35b-a3b Q4_K_M 20,61 GiB oui oui oui 256k
gpt-oss-120b Q4_K_M 58,46 GiB oui oui oui 128k
llama4-scout-17b Q4_K_M 60,87 GiB oui oui oui 256k
qwen3.8-flash-next IQ4_XS 87,25 GiB oui oui oui 256k
deepseek-v4-flash IQ4_XS 127,28 GiB non non non —
glm-5.2 Q4_K_M 433,83 GiB non non non —

Les tailles sont celles des fichiers réellement publiés à la compression de référence, un palier par ligne : Q4_K_M lorsque l’auteur la publie, le voisin le plus proche sinon. Chaque ligne indique laquelle elle affiche. Q4_K_M est notre plancher de qualité : en dessous, la perte s’entend dans les réponses. Un modèle qui ne tiendrait ici qu’avec une compression plus agressive est classé comme ne tenant pas, à dessein. Un tiret dans une colonne de contexte signifie que le modèle n’offre pas ce contexte, il n’y a donc rien à faire tenir.

Modèles qui tiennent — 18 sur les 20 modèles mesurés

Modèles qui ne tiennent pas — 2 sur les 20 modèles mesurés

Les machines voisines

Prix

Prix et disponibilité

Ce que coûte une machine pèse autant que ce qui y tient : le prix a donc sa place sur cette page. Ci-dessous, uniquement ce que publie le fabricant, avec le marché concerné et le jour de la lecture.

À partir de 5.099 $ (États-Unis), publié le 2026-09-23 (Source). Déclaré par le fabricant

C’est le prix de cette configuration exacte : 128 Go avec le disque d’entrée de 512 Go. L’annonce ne cite que 2 499 $, ceux de la base de 36 Go — une autre puce, avec un GPU 32 cœurs et 460 Go/s — : les 128 Go sur lesquels cette fiche est calculée coûtent donc 2 600 $ de plus, et 5 399 $ avec 1 To de stockage. Apple ne publie pas de prix en euros : ce chiffre est en dollars des États-Unis.

Ce que nous gagnons sur cette page

Rien, aujourd’hui. Cette page ne contient aucun lien d’affiliation, et aucun accord commercial ne se cache derrière ses chiffres. Si un lien d’achat y apparaît un jour, il sera signalé comme tel et la commission sera déclarée dans ce même bloc. Deux règles ne changeront pas ce jour-là : le classement de ce site est calculé avant toute disponibilité commerciale, et « meilleur » ne veut jamais dire « paie le plus ».

Notre politique d’affiliation