CoreWeave宣布上线英伟达Vera Rubin NVL72系统与首款面向AI智能体的Vera CPU。Devin开发商Cognition实测显示推理吞吐量提升高达4.8倍,沙盒启动速度提升超3倍。

在旧金山举办的 CoreWeave Fully Connected 大会上,专业 AI 云服务商 CoreWeave 宣布正式上线配备 Spectrum-X 102.4T 以太网的 NVIDIA Vera Rubin NVL72 系统。打造了知名 AI 程序员 Devin 的应用 AI 实验室 Cognition,成为首个在该架构上运行生产级工作负载的客户。
此外,CoreWeave 还将提供专为 AI 智能体打造的 NVIDIA Vera CPU,并同步推出集训练、评估与改进于一体的一站式环境 CoreWeave Forge。
Cognition 在 CoreWeave 上运行 Devin 的模型训练、强化学习及生产推理任务,并在 9 个月内扩展至数千张 GPU。
本月初,CoreWeave 收到首批 Vera Rubin NVL72 生产机架。Cognition 随即基于真实软件工程负载(从 FrontierCode 采样的任务子集),将 Vera Rubin 与 GB200 NVL72 基线进行了对比测试。结果显示:在 SWE-2 推理负载下,Vera Rubin NVL72 的总 Token 吞吐量最高达到了 GB200 NVL72 的 4.8 倍。这意味着 Devin 能够实现更快速的实时代码生成和更灵敏的多步骤复杂推理。
AI 智能体对底层基础设施提出了双重挑战:线上服务需要大规模、低延迟算力,而后训练(Post-training)过程则需要同时运行数千个隔离的执行环境。
NVIDIA Vera CPU 正是为此类负载量身定制。CoreWeave 在单个机架中部署了 128 颗 Vera CPU,提供 11,264 个核心,可支持超过 11,000 个单核隔离并发环境。结合 Spectrum-X 以太网交换机与 BlueField-4 DPU,这些沙盒能与训练任务并行运行,确保低延迟与高安全性。
测试显示,NVIDIA Vera CPU 将智能体沙盒启动速度提升了 3 倍以上,并在 Terminal-Bench 基准测试的所有通过任务中实现了 1.7 倍的性能提升。
为了解决过去工具链割裂导致数据信号流失的问题,CoreWeave Forge 整合了 Weights & Biases、OpenPipe 以及开源 marimo 笔记本,构建起持续优化模型与智能体的统一平台:
此外,开源 AI 工厂推理框架 NVIDIA Dynamo 也为 CoreWeave 的托管推理服务及 RL Rollouts 提供了底层支持。RL Rollouts 允许在服务运行状态下直接加载新检查点,无需停机重新部署即可让后训练获得与生产环境相同的推理效率。
目前,Canva、Capital One 和 MasterClass 已率先接入 Forge,医疗服务提供商 Ennoble Care 也选用 CoreWeave 平台运行临床 AI 智能体推理。从前沿模型团队到全球企业,英伟达与 CoreWeave 正加速推动实验阶段的 AI 智能体转化为可实际落地的生产力系统。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断