10月3日消息,据报道,AI云服务商CoreWeave近日宣布,英伟达Vera Rubin NVL72系统已在CoreWeave Cloud正式投入生产,AI软件公司Cognition成为首个在该平台运行生产工作负载的客户。
Cognition在Vera Rubin NVL72上运行SWE-2推理任务,实测总Token吞吐量较GB200 NVL72提升高达4.8倍。在强化学习场景中,每GPU输出Token吞吐量也达到GB200 NVL72的3.8倍,意味着Devin可同时处理更多会话并加速多步推理。
每瓦性能同样大幅跃升。在DeepSeek-R1推理基准测试中,Vera Rubin NVL72每兆瓦Token吞吐量达到GB200 NVL72的10倍,在相同电力消耗下可产出更多智能输出。
硬件规格方面,NVL72系统由36颗Vera CPU和72颗Rubin GPU构成,采用100%全液冷设计。无缆线模块化托盘设计将安装时间从两小时压缩至五分钟,大幅提升部署效率。
除GPU系统外,CoreWeave还将Vera CPU作为独立计算层提供给客户。单机架部署128颗Vera CPU、总计11264核,可支持超过11000个并发隔离环境,智能体沙箱启动速度比x86 CPU快3倍以上。
CoreWeave同步推出Forge开发环境,将Weights & Biases、OpenPipe等工具整合为统一开发层,覆盖实验追踪、模型评估与生产部署全流程。
英伟达超大规模与高性能计算副总裁Ian Buck表示,CoreWeave的V100 GPU至今仍在运行客户工作负载,而Vera Rubin NVL72已进入生产,这体现了英伟达平台跨代持续创造价值的长期能力。
【本文来源:快•科技】

