NVIDIA ha comenzado a enviar sistemas Vera a socios del ecosistema de inteligencia artificial, en un paso que lleva su procesador central personalizado de la fase de anuncio a la evaluación y el despliegue por parte de proveedores de servicios en la nube y laboratorios de desarrollo de modelos. Las entregas incluyeron a AWS y Oracle Cloud Infrastructure, además de Anthropic, OpenAI y SpaceXAI. NVIDIA publicó el material el 18 de mayo de 2026 y lo actualizó el 27 de agosto de 2026, señalando que los envíos de Vera se realizan a una escala creciente.
Un procesador para funciones que las GPU no ejecutan por sí solas
NVIDIA presenta Vera como su primer procesador central personalizado, diseñado desde el principio para cargas de trabajo de inteligencia artificial agéntica. La empresa explica que estas cargas no se limitan a ejecutar el modelo mediante unidades de procesamiento gráfico, sino que también incluyen la ejecución de entornos aislados, la invocación de herramientas, la gestión de los pasos de ejecución, la recuperación de información desde contextos extensos y la transferencia de datos entre los componentes del sistema.
Según las especificaciones de NVIDIA, Vera incorpora 88 núcleos Olympus diseñados por la empresa, con un ancho de banda de memoria de 1,2 terabytes por segundo. NVIDIA afirma que el procesador alcanza un rendimiento de hasta 1,8 veces por núcleo en cargas de trabajo de inteligencia artificial agéntica frente a la referencia que utiliza, y también señala que la arquitectura integrada con unidades de aceleración puede ofrecer hasta el doble de eficiencia energética que la arquitectura tradicional. Estas cifras proceden de la empresa, y el material no presenta detalles sobre la metodología de las pruebas ni sobre los sistemas de la competencia utilizados para la comparación.
¿Quién recibió los sistemas y qué se está evaluando?
AWS recibió el primer servidor Vera y la primera unidad Vera Rubin GPU en su sede de Seattle, como parte de una ampliación de la colaboración entre ambas empresas, que se extiende desde hace 16 años. Los planes anunciados incluyen añadir dos millones de unidades GPU de NVIDIA y trabajar para incorporar la arquitectura basada en Vera a AWS.
Por su parte, Oracle Cloud Infrastructure afirmó que planea desplegar cientos de miles de procesadores Vera a partir de 2026, y describió a NVIDIA como el primer proveedor de servicios en la nube que desplegará Vera a escala hiperescalar. El material no proporciona un calendario detallado ni información sobre las regiones de la nube en las que estarán disponibles estos sistemas.
SpaceXAI está evaluando el procesador para cargas de aprendizaje por refuerzo y rutas de simulación basadas en agentes. Anthropic y OpenAI también examinaron los sistemas como parte de las primeras entregas, mientras que Anthropic señaló que ampliar la capacidad computacional puede acelerar el crecimiento de los modelos, sin anunciar resultados de pruebas independientes en el material.
El lugar de Vera dentro de la plataforma de NVIDIA
NVIDIA no presenta Vera únicamente como un procesador independiente, sino como parte de un ecosistema que incluye Rubin GPU, BlueField-4 DPU, las redes Spectrum-X y la arquitectura de bastidores MGX. En el sistema Vera Rubin NVL72, Vera funciona como procesador anfitrión para un par de unidades Rubin GPU y se conecta con ellas mediante la segunda generación de NVLink-C2C dentro de una arquitectura de memoria unificada.
En la práctica, NVIDIA apuesta por que el procesador central se encargue de las tareas de control, coordinación y transferencia de datos que podrían limitar el aprovechamiento continuo de las GPU. Esto es importante para los operadores de la nube y los desarrolladores de modelos agénticos, porque aumentar la velocidad de estas tareas auxiliares puede afectar a la latencia y al coste de ejecución de cada tarea, no solo a la velocidad de inferencia.
¿Qué sigue sin estar resuelto?
El inicio de los envíos demuestra que Vera ha pasado a formar parte de sistemas reales en manos de grandes socios, pero por sí solo no demuestra una superioridad práctica generalizada en todas las cargas de trabajo de los agentes. La fuente se basa principalmente en especificaciones y afirmaciones de NVIDIA, y no menciona los precios de los servidores, las condiciones de disponibilidad comercial ni resultados de comparaciones publicados por los clientes. Asimismo, el anuncio de OCI sobre un futuro despliegue a gran escala sigue siendo un plan anunciado, mientras que la viabilidad real de Vera deberá evaluarse de forma independiente mediante distintos tipos de modelos, flujos de herramientas y arquitecturas de nube.