DeepSeek-V4-PRO测试:英伟达Vera Rubin算力能效达GB300的30倍,AI推理成本降至1/35
IT之家 8 月 24 日消息,英伟达昨日使用 SemiAnalysis AgentX 工作负载,以 DeepSeek-v4-PRO 1.6T 模型进行测试,结果显示 Vera Rubin 平台在每兆瓦吞吐量上达到 Blackwell 的 30 倍,再次刷新 AI 算力能效纪录。
每兆瓦吞吐量(Tokens per Megawatt)是衡量 AI 数据中心在固定电力额度下能产出多少 AI Token 的核心能效指标。在 DeepSeek-v4-PRO 1.6T 工作负载中,采用 GB300 NVL72 的 Grace Blackwell 服务器,每兆瓦吞吐量达到 H200 NVL8 Hopper 方案的 15 倍;而 Vera Rubin NVL72 在此基础上进一步提升,每兆瓦吞吐量约为 GB300 NVL72 的 30 倍。
在成本方面,Blackwell 每百万 Token 成本约为上一代的 1/10,而 Vera Rubin NVL72 的每百万 Token 成本更是降至 GB300 NVL72 的 1/35。这意味着运营方可以在相同电力和基础设施预算下支持更多智能体,或大幅降低运营成本,从而持续、大规模地运行 AI 智能体,满足各类工作负载需求。
SemiAnalysis AgentX 通过 4 项指标重点评估智能体编程推理工作负载,包括端到端归一化交互性、标准交互性、端到端延迟和首个 Token 延迟(TTFT)。这些指标全面反映了用户可见输出效率、生成阶段效率以及系统响应速度,为 AI 基础设施的选型提供了重要参考。
此次测试结果展示了英伟达下一代 AI 服务器在能效和成本上的巨大飞跃,也为大模型推理和智能体规模化部署提供了新的可能性。
- 2026-08-25 14:58 | IT之家:DeepSeek-V4-PRO AI 模型测试:英伟达 Vera Rubin 每兆瓦吞吐量达 GB300 的 30 倍阅读原文
IT之家 8 月 24 日消息,英伟达昨日使用 SemiAnalysis AgentX 工作负载,以 DeepSeek-v4-PRO 1.6T 模型评估测试,显示 Vera Rubin 每兆瓦吞吐量达到 Blackwell 的 30 倍。每兆瓦吞吐量(Tokens per Megawatt,简称 tokens / MW)是衡量 AI 数据中心在固定电力额度下能产出多少 AI Token 的核心能效指标。IT之家援引博文介绍,SemiAnalysis AgentX 通过 4 项指标,重点评估智能体编程推理工作负载:端到端归一化交互性按请求提交至最终 Token 到达的完整时间计算,反映包含首个 ...