NAP Latino

Publicado el 07 de agosto de 2026 · Revisado el 07 de agosto de 2026

AMD presentó una mini PC de $1.500 que corre un modelo de 300.000 millones de parámetros sin tocar un centro de datos

En su evento Advancing AI 2026 del 4 de agosto, AMD presentó "Gorgon Halo", una mini PC con hasta 192 GB de memoria unificada capaz de correr modelos de hasta 300.000 millones de parámetros de forma completamente local, por un precio base de $1.500. Es el tipo de hardware que hace que todo lo que hemos venido cubriendo sobre autohospedar IA deje de sonar exclusivo para quien tiene un servidor dedicado.

Durante semanas hemos venido publicando guías para montar tu propio servidor de IA —Ollama, AnythingLLM, agentes que ejecutan tareas por su cuenta— siempre asumiendo que ese servidor era un VPS o una máquina dedicada alquilada a un proveedor de hosting. El anuncio que hizo AMD el 4 de agosto, durante su evento Advancing AI 2026, mueve un poco esa frontera: presentó una mini PC de escritorio, del tamaño de una consola, capaz de correr modelos de hasta 300.000 millones de parámetros sin que un solo dato salga del edificio donde está enchufada.

El equipo se llama "Gorgon Halo" y pertenece a la nueva familia de chips Ryzen AI Max 400. Su especificación más relevante es la memoria: hasta 192 GB de memoria unificada, de los cuales hasta 160 GB pueden asignarse directamente a la GPU integrada. Para dimensionar lo que eso significa en la práctica —y conectarlo con algo que ya explicamos en nuestra guía de dimensionamiento de hardware para IA local—, correr un modelo de 300.000 millones de parámetros normalmente exigía varias GPU de centro de datos trabajando en conjunto, no un equipo que cabe en un escritorio. AMD anunció un precio base de 1.500 dólares, con ASUS, HP y Lenovo como fabricantes de los primeros equipos, disponibles a partir del tercer trimestre de 2026.

El anuncio de Gorgon Halo no fue aislado — formó parte de una presentación de Lisa Su, CEO de AMD, que cubrió toda la escala de infraestructura de IA que la empresa quiere ocupar. Del lado de servidores, AMD presentó los procesadores EPYC "Venice" (la sexta generación de su serie 9006), con hasta 256 núcleos y un salto de rendimiento de 1,8 veces sobre la generación anterior, con entregas planeadas desde el cuarto trimestre de este año. Y presentó también "Helios", un sistema de rack completo con 72 GPU Instinct MI455X que ya está en producción, con una cifra de cómputo de 2,9 exaflops y 31 terabytes de memoria HBM4 — AMD lo compara directamente con la plataforma Vera Rubin de Nvidia, afirmando un 15% más de cómputo, 50% más de memoria, y 30% más de rendimiento por cada dólar invertido en tokens procesados.

Lo que conecta estos tres anuncios —del centro de datos más grande hasta la mini PC de escritorio— es una misma apuesta: AMD está tratando de ofrecer una alternativa real a Nvidia en cada punto de la cadena, no solo en la gama alta. Y para quien sigue esta sección buscando cómo aplicar todo esto a un negocio real, el anuncio de Gorgon Halo es el más directamente relevante de los tres. Ya hemos hablado aquí, en opinión, de por qué la mejor respuesta al fenómeno del "Shadow AI" —empleados pegando información sensible en ChatGPT porque nadie les dio una alternativa segura— es ofrecer una opción autohospedada. Hasta ahora, montar esa alternativa exigía servidores dedicados o VPS con recursos serios. Un equipo de 1.500 dólares que corre modelos de 300.000 millones de parámetros de forma completamente local, sin depender de ningún proveedor externo, hace que esa opción sea alcanzable para negocios que antes ni se lo planteaban por costo de infraestructura.

Vale la pena moderar la expectativa: 1.500 dólares sigue siendo una inversión real para una pyme, y correr un modelo de esa magnitud localmente no va a tener la misma velocidad que un centro de datos con GPU dedicadas de gama alta. Pero la brecha entre "renta cómputo en la nube" y "ten tu propia infraestructura de IA" se está achicando desde ambos extremos: los servidores se vuelven más eficientes, y ahora también el hardware de escritorio empieza a poder hacer lo que hace poco solo hacía un rack completo.