昊梵体育网

英伟达史上首次公布了下一代旗舰级机柜 Vera Rubin NVL72 的首次片上实测数据!#科技先锋官# 而且,这次实测直接拉来了DeepSeek-V4-Pro,跑最真实的「智能体编码」任务! 结果令人吃惊:对比当前的主力机皇GB300 NVL72,Vera Rubin的每兆瓦吞吐量最高飙升了30倍、Token成本最高暴降了35倍! 有人惊 ​

英伟达史上首次公布了下一代旗舰级机柜 Vera Rubin NVL72 的首次片上实测数据!科技先锋官

而且,这次实测直接拉来了DeepSeek-V4-Pro,跑最真实的「智能体编码」任务!

结果令人吃惊:对比当前的主力机皇GB300 NVL72,Vera Rubin的每兆瓦吞吐量最高飙升了30倍、Token成本最高暴降了35倍!

有人惊呼:「我连骗投资人的 PPT 都不敢这么写!」

还有网友神评:「以前嫌 H200 三万美元一张贵,现在回头一看,H200 居然连丐版都算不上了。」

让我们来仔细盘一盘。

从H200到GB300,真实Agent工作负载的吞吐量提升了最高30倍,成本大致翻倍。

从GB300到Vera Rubin,吞吐量再次飙升最高30倍,整机架价格大致再翻倍。

按照老黄的摩尔定律,合着这两年英伟达最大的技术突破不是GPU本身,而是让价格贵了4倍,却换来了整整900倍的速度飞跃!

这次,英伟达向所有人宣布了一个反常识的真相:LLM时代结束,Agent时代降临,以前的AI跑分基准,全部作废!

与此同时,专为智能体打造的Vera CPU,已被马斯克的SpaceXAI连夜装机,甚至准备直接打上太空.

同在今天,英伟达Groq 3 LPX也全面量产。

Gemma 4 31B在上面跑,速度简直绝了,直接干到每秒3400个Token。万亿参数模型吞吐,狂飙35倍。

这些新纪录,直接让Agent生态的商业格局,从今夜开始重写!

为什么英伟达必须推出Vera Rubin?

OpenRouter的最新数据给出了答案:在真实世界里,一个Agent AI任务消耗的Token数量,是普通聊天对话的15倍!

比如,如果让一个Agent为投资决策去研究一家公司,在这个过程中,智能体和子智能体会不断推理,累积的Token成为下一步的输入,长上下文处理,就成为限制智能体AI的最关键要素。

智能体交互次数越多,吞吐量越大——智能体数量多了10倍,工具调用多了2倍,算力和算法的矛盾催生了新的需求。