昊梵体育网

#英伟达VeraRubin实测吞吐提升30倍# 英伟达首次公布下一代 AI 机柜 Vera Rubin NVL72 的片上实测数据。使用 DeepSeek-V4-Pro 运行智能体编码任务时,其每兆瓦吞吐量相比 GB300 最高提升 30 倍,每百万 Token 成本最高下降 35 倍,意味着新一代 AI 基础设施的竞争重点已经不只是单卡性能,而是开始转向 ​

英伟达VeraRubin实测吞吐提升30倍

英伟达首次公布下一代 AI 机柜 Vera Rubin NVL72 的片上实测数据。使用 DeepSeek-V4-Pro 运行智能体编码任务时,其每兆瓦吞吐量相比 GB300 最高提升 30 倍,每百万 Token 成本最高下降 35 倍,意味着新一代 AI 基础设施的竞争重点已经不只是单卡性能,而是开始转向单位功耗下的吞吐和推理成本。

与此同时,英伟达还宣布量产推理加速芯片 Groq 3 LPX,运行 Gemma 4 31B 时输出速度可达 3400 Token/秒,并发布面向智能体工作负载的 Vera CPU。马斯克旗下 SpaceXAI 已宣布部署 Vera CPU,并计划在 2028 年将优化版机柜送上太空。

值得一提的是,Vera Rubin 相比当前 Blackwell 系列的提升幅度已经开始从“几倍”进入“几十倍”区间。如果后续大规模部署数据能够接近此次实测结果,英伟达下一代 AI 计算平台在能效和 Token 成本上的优势可能会比单纯的算力提升更值得关注。