NAP Latino

Publicado el 24 de septiembre de 2026 · Revisado el 24 de septiembre de 2026

Google Cloud Next 2026: dos chips de IA de nueva generación, una plataforma de agentes empresariales y el protocolo que quiere convertirse en el estándar de comunicación entre IAs

Google celebró esta semana su conferencia Cloud Next 2026 con una lista de anuncios orientados a una sola cosa: que la infraestructura de IA en la nube sea el lugar donde ocurra el trabajo real en los próximos años. Los más relevantes para quien opera servidores o construye sobre cloud: los TPU 8t y 8i especializados por workload, la plataforma de agentes empresariales Gemini Enterprise, la integración de Wiz para seguridad autónoma de apps de IA, y el protocolo A2A para comunicación entre agentes.

Google celebró esta semana Cloud Next 2026, su conferencia anual de infraestructura y cloud, con una serie de anuncios que dibujan con bastante claridad hacia dónde va la empresa: convertir Google Cloud en la infraestructura de referencia para el trabajo de agentes de IA a escala empresarial.

Estos son los anuncios más relevantes para quienes trabajan con servidores, cloud y modelos de IA.

TPU 8t y TPU 8i: dos chips para dos problemas distintos

El anuncio de hardware más importante fue la presentación de los TPUs de octava generación — pero no como un solo chip, sino como dos variantes especializadas:

  • TPU 8t ("t" de training): optimizado para entrenar modelos grandes. Más memoria de alta velocidad, mayor ancho de banda entre chips en clúster.
  • TPU 8i ("i" de inferencia): optimizado para servir modelos ya entrenados con la mayor eficiencia posible por token generado. Menor costo de operación por solicitud.

La separación es un reconocimiento de algo que el sector lleva tiempo discutiendo: entrenar y servir un modelo son dos problemas de cómputo completamente diferentes, y un chip diseñado para uno es subóptimo para el otro. Nvidia ha dominado en training con sus GPUs H100/H200/B200, pero Google lleva años apostando a que los TPUs son más eficientes para inferencia a escala, y el 8i es la versión más directa de ese argumento.

Gemini Enterprise Agent Platform: agentes como servicio gestionado

Google presentó la plataforma Gemini Enterprise como el lugar central para construir, desplegar y gestionar agentes de IA dentro de una organización. Incluye herramientas para conectar agentes con sistemas empresariales (bases de datos, APIs internas, herramientas de productividad), monitoreo de comportamiento de agentes en producción, y controles de acceso granulares.

El punto de fondo es que Google quiere ser el lugar donde los agentes de IA vivan una vez que salgan del entorno de desarrollo. Hasta ahora la mayoría de los despliegues de agentes son experimentales o internos — la Gemini Enterprise Platform apunta a que el siguiente paso (agentes operando sobre datos de producción en una empresa real) ocurra en Google Cloud, no en la infraestructura propia del cliente.

A2A: el protocolo para que los agentes se hablen entre sí

Google anunció A2A (Agent-to-Agent), un protocolo abierto para que agentes de IA de distintos proveedores y plataformas se comuniquen entre sí de forma estandarizada. La idea es que un agente de Google Cloud pueda delegar subtareas a un agente de otro proveedor, recibir resultados, y trabajar en flujos de múltiples pasos sin que todo tenga que vivir en la misma plataforma.

Es análogo a lo que HTTP hizo para documentos o a lo que SMTP hizo para el correo: definir un lenguaje común para que sistemas de distintos orígenes puedan interoperar. Si A2A gana adopción, las organizaciones podrían construir pipelines de agentes combinando infraestructura de distintos vendors sin quedar atadas a ninguno en particular — aunque ese escenario favorece a Google si logra posicionarse como el hub central.

Wiz AI-APP: seguridad autónoma para apps de IA

La integración de Wiz — la empresa de seguridad cloud que Google adquirió a principios de 2025 por $32.000 millones — llegó a Cloud Next en forma de AI Application Protection Platform (AI-APP). El producto monitorea aplicaciones de IA desde el código hasta el runtime en producción, detecta configuraciones inseguras, accesos no autorizados a herramientas de agentes, y vulnerabilidades en los modelos y sus integraciones.

La aparición de un producto así en una conferencia de esta escala confirma algo que el sector de seguridad viene señalando desde principios de año: desplegar un agente de IA sin monitoreo especializado es como desplegar una API sin WAF. Los vectores de ataque son diferentes a los de una app web tradicional, y las herramientas de seguridad genéricas no los cubren.

Por qué importa para quien opera fuera de Google Cloud

Los anuncios de Cloud Next 2026 no cambian nada de inmediato para quien tiene sus servidores en otro lugar. Pero marcan la dirección del mercado: la especialización de hardware por workload (8t vs 8i), la estandarización de comunicación entre agentes (A2A), y la aparición de herramientas de seguridad específicas para IA son tendencias que van a llegar a cualquier stack que use modelos de lenguaje, no solo al de Google.

Si ya estás construyendo sobre infraestructura propia con modelos locales (Ollama, OpenHands, Hermes), la pregunta que estos anuncios plantean es cuándo necesitarás las mismas capas de monitoreo y control que Google está vendiendo hoy como premium. Los planes de VDS y servidores dedicados son donde eso ocurre en hardware que controlás vos, sin el bloqueo de proveedor.