AI产业链地图·知识库 AI深度报告解析 · Rubin 推理 TCO
🚧 网站建设中 → 产业链图谱
AI 芯片 · 推理性能与拥有成本

10 倍是拿去年的对手比的
SemiAnalysis 重算 Vera Rubin 的推理账

英伟达新一代机柜 Vera Rubin NVL72 的第一份推理成绩单出自 CoreWeave:每兆瓦吞吐是 GB200 NVL7210 倍。SemiAnalysis 把这个数字拆开看——10 倍的分母是 2025 年的 GB200,一套跑了一年前软件栈的机器。换成同期基线重算,倍数落到 1.9–4.5 倍。但这篇报告真正值钱的判断,不在倍数被砍掉多少,而在曲线右端那一段:有一片工作区间,只有 Rubin 还画得出线。
作者 Alec Ibarra、Dylan Patel 等 8 人 日期 2026 年 7 月 23 日 来源 SemiAnalysis(付费报告)
01

一句话结论:倍数是真的,但它取决于你拿谁当分母

同一台机器,换个基线,从「10 倍」变成「2 倍」

2026 年 7 月 22 日,CoreWeave 公布了 Vera Rubin NVL72 的推理实测:在每用户每秒约 150 个 token 的输出速度下,它的每兆瓦 token 吞吐是 GB200 NVL72 的 10 倍。这是英伟达新一代机柜的第一份公开成绩单,也是英伟达自己在营销材料里主推的那个数字。

SemiAnalysis 的这篇报告没有质疑数据本身,而是去追问一件更基础的事:那个「1 倍」是什么时候的 GB200?

答案是 2025 年的。CoreWeave 对标的 GB200 基线取自它自己一年前的测试——那时 GB200 刚上市,软件栈处于早期调优阶段。把 Rubin 的「今天」和 GB200 的「去年」放在一起比,倍数自然会被放大。SemiAnalysis 因此重算了三条基线:2026 年 7 月的 GB200、2026 年 7 月的 GB300,以及 CoreWeave 那条 2025 年的 GB200,并且把自家 InferenceX 的基准数据按 CoreWeave 的口径重新归一化,才让四条线可比。

核心结论

同期(2026 年 7 月)的 GB200 / GB300 做基线,Rubin 的每兆瓦吞吐优势是 1.88×–4.49×,成本优势是 1.49×–3.87×——不是 10 倍,但仍然是一次实打实的代际跃迁。而那条 2025 年基线之所以能给出 10.18×,是因为它衡量的是一套一年前的软件栈,不是今天你会买到的 GB200。
更重要的是,SemiAnalysis 提醒:Rubin 自己也还在早期——它现在跑的也是刚上线的软件栈,随着内核成熟,这个差距还会继续拉大。两边都不是终局读数。

会 员 档 案 · 免 费 预 览 到 此
登录后继续阅读全文

免费注册即可阅读最新 3 篇深度报告全文;
会员一码解锁全部档案 + 产业链大课 + 白毛速报实时推送

登录 / 免费注册 →

已是会员?登录后本页自动显示全文 · 返回报告目录