News
英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐
1 min read
Source: news.mydrivers.com
快科技10月3日消息,据报道, AI云服务商CoreWeave近日宣布,英伟达Vera Rubin NVL72系统已在CoreWeave Cloud正式投入生产,AI软件公司Cognition成为首个在该平台运行生产工作负载的客户。 Cognition在Vera Rubin NVL72上运行SWE-2推理任务, 实测总Token吞吐量较GB200 NVL72提升高达4.8倍。 在强化学习场景中,每GPU输出Token吞吐量也达到GB200 NVL72的 3.8倍 ,意味着Devin可同时处理更多会话并加速多步推理。 每瓦性能同样大幅跃升。 在DeepSeek-R1推理基准测试中,Vera Rubin NVL72每兆瓦Token吞吐量达到GB200 NVL72的10倍, 在相同电力消耗下可产出更多智能输出。 硬件规格方面,NVL72系统由36颗Vera CPU和72颗Rubin GPU构成,采用 100%全液冷设计 。无缆线模块化托盘设计将安装时间从两小时压缩至五分钟,大幅提升部署效率。 除GPU系统外,CoreWeave还将Vera CPU作为独立计算层提供给客户。单机架部署128颗Vera CPU、总计11264核,可支持超过11000个并发隔离环境,智能体沙箱启动速度比x86 CPU快3倍以上。 CoreWeave同步推出Forge开发环境,将Weights & Biases、OpenPipe等工具整合为统一开发层,覆盖实验追踪、模型评估与生产部署全流程。 英伟达超大规模与高性能计算副总裁Ian Buck表示,CoreWeave的V100 GPU至今仍在运行客户工作负载,而