NVIDIA已开始向人工智能生态系统合作伙伴发运Vera系统,此举使其定制中央处理器从发布阶段进入云服务商和模型开发实验室的评估与部署阶段。交付对象包括AWS和Oracle Cloud Infrastructure,以及Anthropic、OpenAI和SpaceXAI。NVIDIA于2026年5月18日发布相关材料,并于2026年8月27日更新,说明Vera的发货规模正在扩大。
用于GPU单独无法执行的功能的处理器
NVIDIA将Vera定位为其首款定制中央处理器,并从一开始就针对代理式人工智能负载构建。该公司表示,这些负载不仅限于通过图形处理器运行模型,还包括运行隔离环境、调用工具、管理执行步骤、从长上下文中检索信息,以及在系统组件之间传输数据。
根据NVIDIA的规格,Vera搭载88个由该公司设计的Olympus核心,内存带宽达到每秒1.2 TB。NVIDIA称,与其采用的基准相比,该处理器在代理式人工智能负载中的单核性能最高可达1.8倍;该公司还表示,与传统架构相比,与加速器一体化的架构可提供高出两倍的能效。这些数字来自该公司,材料未提供测试方法详情或用于比较的竞争系统。
谁接收了这些系统,以及正在评估什么?
AWS在其西雅图总部接收了首台Vera服务器和首个Vera Rubin GPU机架,作为两家公司扩大16年合作关系的一部分。已公布的计划包括增加200万块NVIDIA GPU,并推进将基于Vera的架构引入AWS。
Oracle Cloud Infrastructure则表示,计划从2026年开始部署数十万颗Vera处理器,并称NVIDIA是首家大规模部署Vera的云服务提供商。材料未提供详细时间表,也未说明这些系统将在哪些云区域提供。
SpaceXAI正在评估该处理器在强化学习负载和基于代理的模拟流程中的表现。Anthropic和OpenAI也在首批交付中检查了这些系统;Anthropic表示,扩大计算能力可能加快模型发展,但材料未公布独立测试结果。
Vera在NVIDIA平台中的位置
NVIDIA并未将Vera仅作为独立处理器推出,而是将其作为一个生态系统的一部分,该生态系统包括Rubin GPU、BlueField-4 DPU、Spectrum-X网络和MGX机架架构。在Vera Rubin NVL72系统中,Vera作为一对Rubin GPU的主机处理器,并通过第二代NVLink-C2C与其连接,采用统一内存架构。
实际上,NVIDIA押注中央处理器将处理控制、协调和数据传输工作,而这些工作可能限制GPU的持续利用率。这对云服务运营商和代理模型开发者具有重要意义,因为提高这些辅助工作的速度可能影响每项任务的延迟和运行成本,而不仅仅是推理速度。
哪些问题仍未确定?
开始发货证明Vera已进入大型合作伙伴的实际系统,但这本身并不能证明其在所有代理负载中都具有广泛的实际优势。该来源主要依赖NVIDIA的规格和声明,未提及服务器价格、商业供应条件或客户公布的对比结果。此外,OCI关于未来大规模部署的声明仍属于已公布计划,而Vera的实际可行性还需要通过不同类型的模型、工具流程和云架构进行独立评估。