【AI 通宵干活的时代来了,但算力正在被 “浪费” 吃掉】
一个人配一个聊天机器人,只在打字时才耗 token;可要是配 3–20 个后台机器人,它们会通宵替你干活 —— 本月 GrokBot 热潮开启了这场序幕,还带来了超低成本的模型。
为什么现在能玩得起?因为廉价模型把门槛打下来了。GLM-5.3-Flash 每百万 token 只要 0.15/0.50 美元,比前沿模型便宜约 10 倍;一个月 20 美元,就能买到 10 倍的工作量。
但便宜的代价是 “浪费”:机器人反复重读同一个代码仓库、重解已经解决的问题、在毫无变化时还一直跑。这种浪费不只是烧钱,是在吞噬吉瓦级算力。破解之道,是缓存、空闲休眠,把最难啃的 5% 任务交给前沿模型,才能守住每一分 token 的价值。
数据更惊人:7 月,头部 1% 的企业每人 AI 花费中位数约 7400 美元,而普通企业只有 11.95 美元 ——AI 的 “超级用户” 红利,多数人还没吃到。
高盛预测到 2030 年 AI 需求增长 24 倍,但前提是智能体还只是 “一个功能”。如果智能体成为工作的默认方式,这个数字可能冲到 200–400 倍 —— 相当于连续 18 个季度、每季度 35%–40% 的环比增长。
这能不能兑现,全看供给端:每 GW 算力能否产出更多 token、每个任务能否消耗更少 token。算力的军备竞赛,拼的不只是堆芯片,更是效率。