行业新闻

英伟达首测 Vera Rubin,DeepSeek 推理吞吐量提升 30 倍

英伟达首测 Vera Rubin,DeepSeek 推理吞吐量提升 30 倍

英伟达 Vera Rubin 实测显示,针对 AI 智能体任务,单位功耗吞吐量较 GB300 提升 30 倍,推理成本降 35 倍,算力标准转向 Agent 工作负载。

英伟达首次公布下一代机柜 Vera Rubin NVL72 的实测数据:在智能体编码任务中,其每兆瓦吞吐量比当前主力 GB300 NVL72 最高提升 30 倍,每百万 Token 成本最高降低 35 倍。所谓智能体,是指能自主调用工具、多步推理的 AI 程序,其 Token 消耗是普通聊天的 15 倍,因此旧基准测试已不适用。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgd1375c05cf.webp) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-192.png) 太炸裂了。 就在刚刚,英伟达史上首次公布了下一代旗舰级机柜 Vera Rubin NVL72 的首次片上实测数据。 而且,这次实测直接拉来了 DeepSeek-V4-Pro,跑最真实的「智能体编码」任务! 结果令人吃惊:对比当前的主力机皇 GB300 NVL72,Vera Rubin 的每兆瓦吞吐量最高飙升了 30 倍、Token 成本最高暴降了 35 倍! ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg9e6558e4cf.webp) 有人惊呼:「我连骗投资人的 PPT 都不敢这么写!」 还有网友神评:「以前嫌 H200 三万美元一张贵,现在回头一看,H200 居然连丐版都算不上了。」 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg20111e8985.webp) 让我们来仔细盘一盘。 从 H200 到 GB300,真实 Agent 工作负载的吞吐量提升了最高 30 倍,成本大致翻倍。 从 GB300 到 Vera Rubin,吞吐量再次飙升最高 30 倍,整机架价格大致再翻倍。 按照老黄的摩尔定律,合着这两年英伟达最大的技术突破不是 GPU 本身,而是让价格贵了 4 倍,却换来了整整 900 倍的速度飞跃!

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-26原文

相关内容