云计算与数据中心

NVIDIA与CoreWeave推动代理式人工智能基础设施投入生产

CoreWeave宣布在其平台上提供NVIDIA Vera Rubin NVL72系统和Spectrum-X网络,并推出连接模型训练、评估与生产运行的新服务。Cognition的测试显示,与用于软件工程工作负载的GB200 NVL72平台相比,总令牌生成速率最高提升4.8倍。

2026-09-30
1 分钟阅读
5 浏览量
certi.news Editorial Team
NVIDIA与CoreWeave推动代理式人工智能基础设施投入生产

CoreWeave宣布在其云平台上提供NVIDIA Vera Rubin NVL72系统,并由Spectrum-X 102.4T Ethernet网络提供支持,此举旨在推动代理式人工智能工作负载从训练和实验阶段进入生产运行。该公司表示,Devin代理软件工程师的开发商Cognition已成为首个在Vera Rubin上运行生产工作负载的客户。

这项声明是在旧金山举行的CoreWeave Fully Connected活动期间发布的,还包括提供面向人工智能代理工作负载设计的NVIDIA Vera处理器的计划,以及推出CoreWeave Forge环境,将模型和代理的训练、评估与持续优化连接起来。

Devin工作负载性能更高

Cognition使用CoreWeave的基础设施训练Devin、开展强化学习并在生产环境中运行推理。在CoreWeave收到首批用于生产的Vera Rubin NVL72机架后,Cognition使用取自FrontierCode的一组软件工程任务对性能进行了比较,并部署代理来解决这些任务。

初步测试显示,与GB200 NVL72基线相比,SWE-2推理工作负载的总令牌生成速率最高提升4.8倍。据消息来源,这一结果在实际应用中意味着代码生成更快,并能更好地响应Devin的多阶段推理过程。原文没有提供足够详细的完整测量方法或测试条件,因此无法确定这一数字在不同环境之间的可比程度。

覆盖人工智能生命周期的统一平台

CoreWeave可通过CoreWeave Kubernetes Service、SUNK、CoreWeave Mission Control、CoreWeave Sandboxes和CoreWeave Inference运行Vera Rubin容量。该公司还宣布,CoreWeave Forge将把Weights & Biases的工具、OpenPipe的后训练经验以及开源项目marimo整合到一个环境中,同时继续对不同模型、框架和云保持开放。

Forge包括面向公众提供的CoreWeave ARIA,用于分析实验、提出修改建议并将其保存到GitHub;还包括新的CoreWeave Agent Lens,用于将生产环境中的代理监控数据转化为优化输入。CoreWeave表示,Agent Lens将故障发现能力提升了20%,并将修复成本降低了一半,但没有提供有关这些比例计算方法的独立细节。

CoreWeave Sandboxes也已面向公众提供,可在CPU或GPU单元上的隔离环境中运行代理、工具调用、强化学习和评估。该公司表示,无服务器强化学习的运行速度提高了1.4倍,成本则比自主管理的配置低40%。

实际发生了什么变化?

最重要的变化并不只是增加新硬件,而是试图缩小代理运行、收集其信号以及随后将这些信号重新用于训练之间的差距。NVIDIA Dynamo是一款开源推理框架,为托管推理服务和处于私有预览阶段的RL Rollouts功能提供支持;后者能够在不重新部署的情况下,将新的检查点加载到线上部署中。

CoreWeave表示,Vera处理器能够在一个机架中容纳128个CPU和11,264个核心,按每个环境分配一个核心时,足以支持超过11,000个并发环境。在测试中,代理环境的启动过程加速了三倍以上,而该处理器在Terminal-Bench的成功任务中实现了1.7倍的收益。

Canva、Capital One和MasterClass正在使用Forge,而Ennoble Care则选择了NVIDIA RTX PRO 6000的预留容量来运行临床人工智能推理。不过,这里提到的大多数性能和成本数据由CoreWeave或其客户提供,因此在将其视为适用于所有代理式人工智能工作负载的普遍指标之前,仍需进行独立审查。

新闻来源
NVIDIA AI Blog
查看原始来源 ↗
c
作者

certi.news Editorial Team

同一分类

你可能还喜欢

查看所有新闻