谁能想到,这场让全球程序员集体离线、ChatGPT、Claude、Grok、Gemini 乃至 Cursor 全线瘫痪的赛博大崩塌,元凶居然是同一个人:马斯卡。
美东时间 9 月 3 日上午,先是 Grok 转圈,紧接着 Claude 拒绝生成代码,OpenAI 官方页面直接刷出了 15 个组件报错,就连写代码的开发者工具 Cursor 都开始胡言乱语。
Downdetector 在短短一小时内收到了超过 3.7 万份故障报告。大家原本以为这是全球互联网主干网遭到了某种神秘力量的进攻,结果 SpaceXAI 弹出一条致歉声明,直接让全网破防:
“不好意思,我们位于孟菲斯的 Colossus 计算中心今早断电了。对 Grok 用户表示抱歉,同时也向受影响的算力合作伙伴道个歉。”
请注意这个词——“算力合作伙伴”。
合着你们这群市值几千亿的硅谷科技巨头,平时在公关战和基准测试里撕得不可开交,底层却在马斯克的算力大排档里“拼桌”呢?
为了平摊那个拥挤着十万张 GPU、每天光散热就要喝掉几千吨水的超级计算中心的恐怖账单,SpaceXAI 悄悄把机房里的机柜打包转租给了竞争对手们。
你以为你在用 Anthropic 顶尖的 Claude 模型做架构设计,其实它的推理节点和隔壁 Grok 塞在同一个机架里,连公用的排插都是同一个牌子。
这暴露出当今 AI 行业最荒诞的物理软肋:超级集群的单点危机。
传统互联网架构追求的是多可用区冗余,东京节点挂了能自动秒切新加坡。但大模型完全是另一码事,万亿参数的矩阵运算需要几万张 GPU 之间维持微秒级的 InfiniBand 互联。一旦你把算力拆开散落到不同州,光是光纤里的光速延迟就能把推理效率卡成 PPT。
为了追求极限性能,AI 巨头们被迫放弃了互联网行业积攒了三十年的“冗余安全感”,把所有的算力鸡蛋都砸进了孟菲斯这个物理大篮子里。
更幽默的是后续的连锁反应。当孟菲斯的机房一黑,全球几百万个自动化脚本和慌乱的开发者立刻启动了自动灾备——所有流量一股脑全往 OpenAI 和 Google 身上砸。这就好比一条街上的三家餐馆突然有两家断电了,所有饿肚子的顾客一瞬间全部挤进第三家。
结果就是,原本没用孟菲斯算力的平台,也被这股恐怖的流量洪峰直接压垮,演变成了整整 3 小时 37 分钟的全球大宕机。完美演绎了什么叫“一人跳闸,全村吃席”。
我们总以为人工智能的终局是意识觉醒或人机共生,但这次宕机给全人类泼了一盆冰凉的醒酒汤:
硅谷距离 AGI 也许只差临门一脚,但这一脚到底能不能踢出去,主要看当地电力局今天管不管饱。
