昊梵体育网

英伟达的 GPU 喂出来的 AI,正在设计一颗拆英伟达台子的芯片——这个魔幻剧情

英伟达的 GPU 喂出来的 AI,正在设计一颗拆英伟达台子的芯片——这个魔幻剧情,昨天官宣了。OpenAI 跟博通合作的推理芯片 Jalapeño,设计到流片只用了 16 个月,每瓦吞吐是 Blackwell 的 1.9 倍、延迟低 3.6 倍,700 瓦干 1400 瓦的活,跑 DeepSeek R1、Kimi K2.5 都超 700 token/s/用户。

还没开软件优化,对手全是满配置——赢在架构。

比跑分更狠的是成本账,Jalapeño 每小时总拥有成本约 1.56 美元,跟 H100 的 1.55 美元打平,性能却是数倍差距,对比 Vera Rubin 的 3.61 美元直接腰斩。

芯片圈真正吓人的,是跑得快还更便宜——这才是能持续碾压的东西。

我看到的是盘更大的棋——AI 竞争不讲算力,讲电费了。

数据中心卡的不是预算、占地,是电力。OpenAI 死磕每瓦性能,把 token 成本按到地板上,也把命脉从英伟达手里拿回来,训练还租、推理自己造。

从买算力到造算力,AI 公司第一次在硬件层面跟芯片巨头正面掰手腕。

小米走另一条路。玄戒 O100 端侧芯片 6nm 3D 堆叠、1.22TB/s 带宽,330 Tokens/s 本地跑大模型,不烧数据中心的电。

一个云端省电,一个端侧不费电,殊途同归:把 AI 成本打下来,它才能从工具变成基础设施。

最讽刺的是,这颗芯片是 AI 自己设计的,AI 写的模块比人类顶尖专家快 1.5 到 1.8 倍,SIMD 面积缩小 8%、矩阵引擎缩小 10%。

用英伟达 GPU 训出来的模型,设计干掉英伟达的芯片——这个飞轮转起来,半导体设计几十年的玩法都要被改写。

也别急着说英伟达完了,消息出来股价不跌反涨 2%,OpenAI 明确训练仍大量用英伟达。

CUDA 护城河可能正被填平,但英伟达不只是卖显卡的。

对普通人就一句话,模型再聪明,用不起都是白搭。

等 AI 推理便宜得像今天的流量,它才真正改变生活,而不只是发布会 PPT。

你猜明年这时,AI 对话价格能降到现在的几成?评论区立个 flag。英伟达芯片需求 英伟达AI工厂 英伟达AI模型 英伟达芯片架构 英伟达 openai OpenAI