ITCOW牛新网 7月22日消息,英伟达昨日发布博文宣布,新一代机架级 AI 计算系统 Vera Rubin NVL72 正加速向万亿级规模部署迈进,目前已在 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴的数据中心内部启动运行。为支撑全球客户需求,Vera Rubin 在 30 个国家布局超 350 家工厂,构建了英伟达史上规模最大、成熟度最高的机架级供应链体系。

英伟达 Vera Rubin NVL72 量产提速:DeepSeek R1 实测每兆瓦吞吐较 GB200 提升 10 倍

CoreWeave 同日披露,其于 6 月初完成了业界首个 NVIDIA Vera Rubin NVL72 的上电与端到端验证,电源、冷却、网络及计算子系统全部跑通,标志着新架构从纸面规格走入了可商用机架形态。

据ITCOW牛新网了解,英伟达选取驱动当前智能体 AI 浪潮的 DeepSeek R1 作为推理基准,在相同工作负载与匹配的交互性目标(TPS/user)下,对比上一代 NVIDIA GB200 NVL72,Vera Rubin NVL72 的每兆瓦 Tokens 吞吐量提升达到 10 倍——这一指标直接决定数据中心在单位能耗下能挤出多少有效推理产能,对大规模部署 DeepSeek R1 这类重型推理模型的云厂商而言,意味着同等电力预算可承载十倍量级的并发智能体任务。

随着 Vera Rubin 在多家超大规模云上陆续点亮,英伟达正把竞争锚点从单卡算力转向“每瓦特产出”的机架级效率,而 DeepSeek R1 实测 10 倍能效跃升的数据,也为后续 AI 推理成本下探与智算中心功耗管控提供了关键参照。