一边是CPU厂商集体讲故事,一边要正视AI产业中CPU配比增高的实际趋势。
最近半导体圈又热闹了。
AMD CEO苏姿丰放话:传统数据中心里CPU与GPU的配比是1:4,到2026年要演进成1:1。英特尔的新任掌门陈立武更猛,直接喊出未来可能达到4:1。
一时间,"CPU王者归来"、"GPU算力泡沫"的论调甚嚣尘上。
先说说这两位大佬的数字游戏。
苏姿丰的1:1和陈立武的4:1,听起来像是CPU要重新夺回数据中心的主导权。但当前产业共识其实集中在1:1到1:2的区间,而且这个比例主要适用于智能体密集型任务。
什么意思?就是不是所有AI任务都需要这么多CPU,而是只有在智能体调用场景下,CPU配比才需要明显提升。对于基础的模型推理、训练任务,传统的1:4配比依然更经济高效。
厂商把数字说得这么夸张,本质上是在讲一个"CPU复兴"的资本故事。AMD和英特尔在GPU时代被英伟达压得喘不过气,现在好不容易等到AI应用形态变化给CPU创造了新需求,当然不能放过这个机会。
吐槽完厂商,我们得承认:CPU在AI架构中的角色确实在发生质变。
过去在大模型训练和简单推理中,CPU就是个"打杂的"——负责数据预处理、任务启动、结果汇总,GPU才是绝对主角。但现在AI应用正在从"大模型训练"转向"智能体AI",这个转变彻底改变了CPU的定位。
在智能体场景中,CPU承担的任务已经远超传统辅助角色。它成了任务编排、工具调度和状态管理的核心执行单元。一个Agent要调用搜索引擎、查数据库、执行代码、管理多轮对话状态,这些控制流逻辑几乎全跑在CPU上。
在端到端延迟中,CPU工作量占比达到50%-90%;在工具调用相关的Agent工作流中,CPU延迟占比最高可达90.6%。
这意味着你的GPU就算再强,如果CPU调度跟不上,整个系统照样卡死。更残酷的是,一旦CPU调度延迟超过GPU计算时间,GPU利用率会骤降至30%以下。
从这个角度说,AI智能体的任务复杂度提升,导致了刚性增长。这个趋势是真实的,而且会越来越明显。
最后说一点,现在先进封装把CPU、内存、GPU通过3D堆叠等先进封装技术捆在一起,有效降低了物理层延迟,让CPU和GPU之间的数据传输更快。
但智能体工作流中的延迟瓶颈,根源在于控制流逻辑本身。也就是Agent决策"下一步该调用什么工具、怎么编排任务"这个过程。这种逻辑层面的延迟,不是靠把芯片贴得更近就能消除的。
况且,先进封装目前价格高昂,性价比远不如采用独立CPU+GPU的均衡配比方案。
说到底,这场CPU与GPU配比之争,本质上反映了AI计算架构的范式转移。
过去几年的逻辑是"GPU万能论":堆算力就能解决一切。但现在,随着AI从"训练大模型"走向"构建智能体系统",控制复杂度超过了纯计算复杂度,CPU的价值自然水涨船高。
总结一下,未来算力优化的关键,将从单纯提升GPU性能,转向CPU-GPU协同效率。

