9.0
重磅
AI SCORE
模型发布2026-08-25 14:58
英伟达Vera Rubin能效曝光:每兆瓦吞吐量是GB300的30倍
IT之家#英伟达#Vera Rubin#能效
Editor brief · 编辑速览
SemiAnalysis用DeepSeek-V4-PRO 1.6T测试显示,Vera Rubin NVL72的每兆瓦吞吐量约为GB300的30倍,每百万Token成本仅为GB300的1/35,标志能效重大飞跃。
英伟达昨日使用 SemiAnalysis AgentX 工作负载,以 DeepSeek-V4-PRO 1.6T 模型进行评估测试,结果显示 Vera Rubin 每兆瓦吞吐量达到 Blackwell 的 30 倍。
每兆瓦吞吐量(Tokens per Megawatt,简称 tokens/MW)是衡量 AI 数据中心在固定电力额度下能产出多少 AI Token 的核心能效指标。

SemiAnalysis AgentX 通过 4 项指标,重点评估智能体编程推理工作负载:
在 DeepSeek-V4-PRO 1.6T 工作负载中,采用 GB300 NVL72 的 Grace Blackwell 服务器,每兆瓦吞吐量达到 H200 NVL8 Hopper 方案的 15 倍。

Blackwell 每百万 Token 成本约为上一代的 1/10,运营方可以在相同电力和基础设施预算下支持更多智能体,或以更低运营成本维持相同智能体容量。

而 Vera Rubin 进一步提升该优势,在 DeepSeek V4 Pro 模型上,Vera Rubin NVL72 的每兆瓦吞吐量约为 GB300 NVL72 的 30 倍。

Vera Rubin NVL72 的每百万 Token 成本是 GB300 NVL72 的 35 分之一,能够持续、大规模地运行智能体,满足客户各种工作负载的需求。

