AMD muestra el Ryzen AI Max+ PRO 495 ejecutando modelos locales de hasta 320.000 millones de parámetros
por Manuel Naranjo
Veinte tokens por segundo con GLM 5.3 Flash y 42 con Qwen 3.8 Flash Next son dos de las cifras que AMD ha mostrado para el Ryzen AI Max+ PRO 495. Proceden de pruebas realizadas por la compañía con modelos distintos, por lo que no sirven para ordenar su rendimiento entre sí ni equivalen a una comparación independiente con otros procesadores.
La presentación se centró en los llamados Agentic PCs, equipos preparados para ejecutar agentes de IA en local durante tareas prolongadas. AMD afirma haber distribuido más de medio millón de ordenadores de esta categoría en más de 50 diseños. La cifra queda separada de las decenas de millones de PC con IA que dice haber suministrado en más de 250 diseños.
Hasta 192 GB de memoria unificada en el Ryzen AI Max+ PRO 495
El protagonista de las pruebas es el Ryzen AI Max+ PRO 495, conocido durante su desarrollo como Gorgon Halo. Su ficha oficial recoge 16 núcleos Zen 5, 32 hilos, una GPU Radeon 8065S de 40 unidades de cómputo y soporte para hasta 192 GB de memoria LPDDR5X unificada.
Esa capacidad ya había sido anunciada al presentar la familia Ryzen AI Max 400. La novedad de esta sesión son las pruebas con modelos concretos y las cifras comerciales que AMD ha asociado a su estrategia de PC para agentes. La capacidad máxima no significa que todos los equipos con este procesador incluyan 192 GB.
La memoria puede repartirse entre las tareas del sistema y la GPU integrada. AMD señala que es posible reservar hasta 160 GB para trabajo gráfico, un ajuste que deja el resto para el procesador y otras aplicaciones. En su demostración asignó esa cantidad a los modelos de lenguaje y empleó 128 GB para una prueba con ComfyUI.
AMD relaciona esa configuración con la posibilidad de ejecutar modelos de más de 300.000 millones de parámetros cuantizados a 4 bits. La cifra de parámetros indica el tamaño del modelo, pero no explica por sí sola su velocidad ni la memoria adicional que pueden requerir el contexto y las herramientas utilizadas por un agente.
Las demostraciones alcanzan 20 y 42 tokens por segundo

Para GLM 5.3 Flash, AMD mostró hasta 20 tokens por segundo con un modelo de 320.000 millones de parámetros. La prueba utilizó una cuantización mixta UD-IQ4_XS. No sería preciso trasladar ese resultado a cualquier versión o configuración de GLM.
La cifra de hasta 42 tokens por segundo correspondía a Qwen 3.8 Flash Next. La información de la presentación describe 125.000 millones de parámetros principales y otros 51.000 millones para embeddings, con aproximadamente 4.000 millones activos por token. AMD utilizó cuantización dinámica de 4 bits y MTP en esa medición.
Las diferencias entre modelos, formatos y parámetros activos impiden interpretar 42 frente a 20 como una mejora del procesador. Son dos cargas de trabajo.
Una diapositiva anuncia soporte para modelos de 300.000 millones de parámetros, mientras que una nota con fecha anterior todavía menciona el límite de 200.000 millones de la configuración previa de 128 GB. La referencia más reciente de AMD atribuye el salto a los equipos Ryzen AI Max PRO 400 con hasta 192 GB.

La comparación con Intel usa equipos de distinta memoria
AMD enseñó resultados de ComfyUI frente a un Intel Core Ultra X9 388H. En 17 de las 18 cargas generativas representadas, la configuración de AMD quedó por delante, con ventajas declaradas de 1,1 a 32,2 veces. El extremo superior corresponde a una prueba concreta y no debe presentarse como rendimiento general.
Hay una diferencia que condiciona la lectura: el equipo Ryzen AI Max+ PRO 495 tenía 192 GB de memoria unificada y 128 GB asignados a la GPU, mientras que el ordenador Intel de la comparación montaba 64 GB. Una carga que no cabe con holgura en una de las configuraciones puede generar una distancia grande sin que esta se repita en tareas más pequeñas.
La gráfica procede de AMD. La compañía no acompañó esta presentación de una comparación directa con los portátiles RTX Spark de NVIDIA ni de pruebas de aplicaciones generales. Hasta disponer de ensayos con memoria y condiciones equiparables, estos resultados describen las configuraciones elegidas por el fabricante.

Un caso de uso local y herramientas profesionales
AMD expuso el trabajo de Light Sail VR, estudio que desarrolló un coordinador de producción basado en IA. El proyecto comenzó en un Framework Desktop con Ryzen AI Max y 128 GB de memoria y después pasó a un sistema con gráfica Radeon AI PRO R9700. El equipo consulta al agente mediante Slack para gestionar calendarios, documentos y comunicaciones.
Matthew Celia, fundador del estudio, atribuye al sistema la posibilidad de coordinar más trabajos de forma simultánea y mantener información de clientes en local. Es el relato de la empresa participante; AMD no presentó una verificación independiente de esas mejoras.
La compañía también citó compatibilidad con Windows y Linux y herramientas como PyTorch, Ollama, ComfyUI y LM Studio. Las cifras de rendimiento publicadas quedan ligadas al Ryzen AI Max+ PRO 495 y a las pruebas seleccionadas por AMD.
Fin del Artículo. ¡Cuéntanos algo en los Comentarios!



