Vera Rubin NVL72推理测试:1.6T DeepSeek模型每兆瓦Token吞吐量达Blackwell 7倍,超黄仁勋3倍说法
talkingdev • 2026-09-15
2630 views
SemiAnalysis最新披露的推理测试结果显示,NVIDIA下一代Vera Rubin NVL72平台在运行1.6万亿参数的DeepSeek模型时,每兆瓦功耗下的Token吞吐量最高达到Blackwell平台的7倍,明显高于黄仁勋此前对1T-3T规模LLM给出的3倍提升预期。该报告以“Jensen再次保守”形容这一差距,并指出每吉瓦年利润有望提升约2倍。测试还涉及AgentX、InferenceX和Extreme Co-Design等推理优化与系统协同设计技术,反映出NVIDIA正将能效和推理经济性作为超大规模AI部署的关键指标。对数据中心运营商而言,每MW Token吞吐量的跃升意味着万亿参数MoE模型推理成本显著下降,也为代理式AI的大规模落地提供了更强的算力效率支撑。Vera Rubin NVL72在DeepSeek等大模型上的表现,预示着下一代AI基础设施正从单纯峰值算力竞争转向以能效、吞吐和单位经济效益为核心的全面较量。
核心要点
- Vera Rubin NVL72在1.6T DeepSeek模型上每兆瓦Token吞吐量最高达Blackwell的7倍
- 该结果高于黄仁勋对1T-3T LLM宣称的3倍提升,被SemiAnalysis称为“Jensen再次保守”
- 能效提升带来每吉瓦年利润约2倍增长,并强化万亿参数模型的推理经济性