热门搜索:和平精英 原神 街篮2 

您的位置:首页 > > 教程攻略 > ai资讯 >DeepSeek R1 推理 AI 测试:英伟达 Vera Rubin NVL72 每兆瓦 Tokens 吞吐量提升 10 倍

DeepSeek R1 推理 AI 测试:英伟达 Vera Rubin NVL72 每兆瓦 Tokens 吞吐量提升 10 倍

来源:互联网 更新时间:2026-07-22 13:42

7月22日,英伟达发布博文,正式宣布其 Vera Rubin 平台正在向万亿级规模部署迈进。这可不是画饼——公司明确表示,Vera Rubin NVL72 正在加速量产,而且已经在 CoreWea ve、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴内部跑起来了。

DeepSeek R1 推理 AI 测试:英伟达 Vera Rubin NVL72 每兆瓦 Tokens 吞吐量提升 10 倍

为了支撑全球客户的计算需求,Vera Rubin 在 30 个国家部署了 350 多个工厂,搭建了有史以来规模最大、最成熟的机架级供应链。这背后是英伟达对大规模推理算力的全力押注。

同样在昨天(7月21日),CoreWea ve 也发了一篇博文,透露他们早在 6 月初就完成了业界首个 NVIDIA Vera Rubin NVL72 的上电和验证工作。整个端到端的机架级系统——电源、冷却、网络、计算——全部验证通过,已经跑起来了。这速度,确实够快。

翻译一下 CoreWea ve 博文的核心内容:

DeepSeek R1 是当前推动智能体 AI(Agentic AI)爆发式增长的关键推理模型之一。在部署 Vera Rubin NVL72 和 NVIDIA Blackwell NVL72 之后,我们基于该模型做了对比测试。评估重点在于每兆瓦吞吐量(token throughput per megawatt)与交互性(TPS/user,即用户或智能体在模型处理任务时感受到的响应速度)之间的平衡。在相同的交互性目标下,面对同样的 DeepSeek R1 工作负载,

Vera Rubin NVL72 的每兆瓦 Tokens 吞吐量相比 NVIDIA GB200 NVL72 提升了整整 10 倍。

简单来说,Vera Rubin 这次在能效和推理性能上的跨越,已经不是简单的迭代升级,而是量级的跃迁。对于正在大规模部署推理集群的云厂商和 AI 公司来说,这意味着同样的电力预算,能支撑十倍以上的用户请求。这才是真正值得关注的点。

热门手游

相关攻略

手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc