Inicio›Equipos›PC con Ryzen AI Max+ PRO 495 y 192 GB unificados
PC con Ryzen AI Max+ PRO 495 y 192 GB unificados
chip AMD con memoria unificada192 GiB273 GB/s15,4 TFLOPS
Este equipo deja 160,00 GiB para el modelo una vez el sistema coge lo suyo, y admite 19 de los 20 modelos que medimos en la compresión de referencia. Lo que decide su velocidad de respuesta no es el chip: son los 273 GB/s de ancho de banda de memoria.
Queda para el modelo
Estimación propia
Ancho de banda de memoria
Estimación propia
Modelos que caben
Medido por Local AI Scope
Vídeos: PC con Ryzen AI Max+ PRO 495 y 192 GB unificados 2
Lo oficial y las mejores pruebas que hemos encontrado. Pulsa y se abre aquí mismo.
Los vídeos están en YouTube y no se carga nada de allí hasta que pulsas (modo sin cookies). La miniatura la servimos nosotros.
La memoria que de verdad puedes usar
La memoria unificada la comparte el sistema operativo con todo lo que tengas abierto. La reserva de aquí es deliberadamente conservadora; puedes cambiarla en la herramienta.
| Memoria | GiB |
|---|---|
| Memoria del equipo | 192 |
| Reservada al sistema | −3,00 |
| Por encima del límite que el fabricante pone a la GPU | −29,00 |
| Queda para el modelo | 160,00 |
192 GB en la caja, 160 para el modelo. AMD dice que el Ryzen AI Max+ PRO 495 puede dedicar hasta 160 GB de sus 192 GB al procesador gráfico, y el procesador gráfico es el que mueve el modelo. Por eso todas las cifras de esta página están calculadas con 160, no con los 189 que saldrían de restar a la caja nuestra reserva de sistema. En Linux ese límite es un ajuste del controlador que AMD documenta como ampliable, pero no publica una cifra máxima: nos quedamos con la que sí publica.
Ancho de banda de memoria
Son dos límites distintos y se confunden constantemente. Mientras el modelo escribe la respuesta manda el ancho de banda: cada token obliga a releer los pesos enteros, así que los tokens por segundo son aproximadamente el ancho de banda dividido entre el tamaño del modelo. Mientras el modelo lee tu documento manda el cómputo: la entrada se procesa de una vez. Por eso un portátil sin GPU puede tardar minutos en soltar la primera palabra y luego escribir a un ritmo tolerable.
273 GB/s — Derivado, no publicado por el fabricante · el fabricante publica el ancho del bus pero ni la velocidad de la memoria ni el ancho de banda. Esta cifra es la derivación aritmética habitual () y no hemos podido confirmarla en origen (Fuente).
Cómputo: 15,4 TFLOPS (estimación para esta clase de equipo) — Estimado · el fabricante no publica esta cifra en ninguna parte; la nuestra es una estimación conservadora, no una especificación. Las cifras de esta línea no salen todas de la misma medida según el equipo, porque cada fabricante publica una distinta. Compáralas entre equipos sabiendo eso.
Qué modelos entran aquí y cuáles no
Que quepa significa que caben tres cosas a la vez en la memoria que sobra: el fichero del modelo, su memoria de contexto y el margen de trabajo del runtime. La memoria de contexto se calcula con el patrón de atención que cada modelo declara capa a capa, no con la fórmula genérica: por eso aquí caben modelos que otras calculadoras dan por imposibles.
| Modelo | Compresión mostrada | Tamaño del modelo | 8k | 32k | 128k | Mayor contexto que cabe |
|---|---|---|---|---|---|---|
| qwen3-1.7b | Q4_K_M |
1,03 GiB | sí | sí | — | 32k |
| qwen3-4b-2507 | Q4_K_M |
2,33 GiB | sí | sí | sí | 256k |
| gemma4-e2b | Q4_K_M |
2,89 GiB | sí | sí | sí | 128k |
| gemma4-e4b | Q4_K_M |
4,63 GiB | sí | sí | sí | 128k |
| qwen3-8b | Q4_K_M |
4,68 GiB | sí | sí | — | 32k |
| granite-4.2-8b | Q4_K_M |
4,98 GiB | sí | sí | sí | 128k |
| gemma4-12b | Q4_K_M |
6,63 GiB | sí | sí | sí | 256k |
| gpt-oss-20b | Q4_K_M |
10,83 GiB | sí | sí | sí | 128k |
| mistral-small-24b | Q4_K_M |
13,35 GiB | sí | sí | sí | 128k |
| qwen3.8-27b | Q4_K_M |
15,33 GiB | sí | sí | sí | 256k |
| qwen3.6-27b | Q4_K_M |
15,66 GiB | sí | sí | sí | 256k |
| gemma4-26b-a4b | Q4_K_M |
15,78 GiB | sí | sí | sí | 256k |
| gemma4-31b | Q4_K_M |
17,07 GiB | sí | sí | sí | 256k |
| qwen3-coder-30b | Q4_K_M |
17,28 GiB | sí | sí | sí | 256k |
| qwen3.6-35b-a3b | Q4_K_M |
20,61 GiB | sí | sí | sí | 256k |
| gpt-oss-120b | Q4_K_M |
58,46 GiB | sí | sí | sí | 128k |
| llama4-scout-17b | Q4_K_M |
60,87 GiB | sí | sí | sí | 256k |
| qwen3.8-flash-next | IQ4_XS |
87,25 GiB | sí | sí | sí | 256k |
| deepseek-v4-flash | IQ4_XS |
127,28 GiB | sí | sí | sí | 256k |
| glm-5.2 | Q4_K_M |
433,83 GiB | no | no | no | — |
Los tamaños son los de los ficheros realmente publicados en la compresión de referencia, un escalón por fila: Q4_K_M donde el autor la publica y el vecino más cercano donde no. Cada fila dice cuál está enseñando. Q4_K_M es nuestro suelo de calidad: por debajo la pérdida se nota en las respuestas. Un modelo que solo cabría aquí con una compresión más agresiva figura como que no cabe, a propósito. Un guion en una columna de contexto significa que el modelo no ofrece ese contexto, así que no hay nada que encajar.
Modelos que caben — 19 de los 20 modelos medidos
- qwen3-1.7b
Q4_K_M— contexto 32k tokens - qwen3-4b-2507
Q4_K_M— contexto 256k tokens - gemma4-e2b
Q4_K_M— contexto 128k tokens - gemma4-e4b
Q4_K_M— contexto 128k tokens - qwen3-8b
Q4_K_M— contexto 32k tokens - granite-4.2-8b
Q4_K_M— contexto 128k tokens - gemma4-12b
Q4_K_M— contexto 256k tokens - gpt-oss-20b
Q4_K_M— contexto 128k tokens - mistral-small-24b
Q4_K_M— contexto 128k tokens - qwen3.8-27b
Q4_K_M— contexto 256k tokens - qwen3.6-27b
Q4_K_M— contexto 256k tokens - gemma4-26b-a4b
Q4_K_M— contexto 256k tokens - gemma4-31b
Q4_K_M— contexto 256k tokens - qwen3-coder-30b
Q4_K_M— contexto 256k tokens - qwen3.6-35b-a3b
Q4_K_M— contexto 256k tokens - gpt-oss-120b
Q4_K_M— contexto 128k tokens - llama4-scout-17b
Q4_K_M— contexto 256k tokens - qwen3.8-flash-next
IQ4_XS— contexto 256k tokens - deepseek-v4-flash
IQ4_XS— contexto 256k tokens
Modelos que no caben — 1 de los 20 modelos medidos
- glm-5.2
Q4_K_M— le faltan 289,13 GiB
Los equipos de al lado
- Xiaomi AI Cube, 80 GB — prototipo de ingeniería — 77,00 GiB para el modelo, 17 / 20 modelos
- PC con Ryzen AI Max+ 395 y 128 GB unificados — 96,00 GiB para el modelo, 18 / 20 modelos
- Mac Studio con M5 Max y 128 GB unificados — 125,00 GiB para el modelo, 18 / 20 modelos
- Mac Studio con M5 Ultra y 512 GB unificados — 509,00 GiB para el modelo, 20 / 20 modelos
Precio y disponibilidad
Lo que cuesta una máquina decide tanto como lo que le cabe, así que el precio pertenece a esta página. Aquí abajo va solo lo que publica el fabricante, con el mercado al que se aplica y el día en que se leyó.
Desde 6.599 $ (Estados Unidos), publicado el 2026-10-01 (Fuente). Declarado por el fabricante
Qué ganamos con esta página
Nada, hoy. En esta página no hay ni un enlace de afiliado ni un acuerdo comercial detrás de ninguna de sus cifras. Si alguna vez aparece aquí un enlace de compra, irá marcado como tal y la comisión se declarará en este mismo bloque. Dos reglas no cambian ese día: el ranking de este sitio se calcula antes de aplicar la disponibilidad comercial, y «mejor» no significa nunca «paga más».

