昊梵体育网

美国网友热泪盈眶:中国菩萨,竟让一个美国人下载这么好的AI模型。   7月27日

美国网友热泪盈眶:中国菩萨,竟让一个美国人下载这么好的AI模型。
 
7月27日,Kimi K3的完整模型权又重挂上了Hugging Face,2.8万亿参数,全球首个3万亿级别的开源模型。

Hugging Face的CEO说,上线30分钟就收了超4000个赞,创了平台最快增长纪录。

X上一位美国网友发了条推文,说正在下载Kimi K3的权重,感叹自己何德何能可以用到这么好的模型,还不花一分钱。

他说这感觉像是摆脱了永久底层阶级。他还专门@了杨植麟,说了声谢谢。这条推文几千条转发。

但这事儿的魔幻程度,远不止一个美国老哥的感慨。

7月16日K3发布后72小时内,美股AI板块蒸发约4700亿美元。费城半导体指数一周跌了12.5%,直接跌进技术性熊市。英伟达跌了5.3%。摩根大通在报告里直接管这叫“DeepSeek 2.0”。

同一时间,港股“大模型第一股”智谱暴跌28.49%,MiniMax重挫15.62%。一个中国AI模型的开源,把全球科技股干趴了。

更要命的是K3展示的一项能力:它借助开源EDA工具,用48小时独立完成一颗4mm²芯片的设计、优化与验证,集成146万个标准单元。

EDA板块闻声暴跌,新思科技跌7.85%,铿腾电子跌9.47%。当大模型能自己设计芯片了,市场怕的不是一两家公司丢订单,是整个EDA工具链的定价逻辑要重写。

K3在Frontend Code Arena上拿了1679分,超过Claude Fable 5的1631分和GPT-5.6 Sol的1618分。这是开源模型第一次在权威编程榜上压过所有闭源模型。

Artificial Analysis智能指数上它排第三,前面只剩Fable 5和GPT-5.6 Sol。

技术上也确实下了功夫。KDA混合线性注意力机制在百万token级别上下文里实现了6.3倍解码加速。注意力残差让每层能直接从任意更早的层里捞信息。896个专家模块每次只激活16个。

量化感知训练从微调阶段就开始了。这些加在一起,扩展效率比上一代K2提升了约2.5倍。

但硅谷真正慌的不是跑分。

K3的API定价是每百万输出token 15美元。不到Fable 5的三分之一。

一个接近前沿水平的模型,价格只有对手的三分之一,还要把权重全公开。这三个东西放一起,等于直接告诉全球开发者:以后不用交租了。
 
更让硅谷坐不住的是,Kimi的模型早就悄悄嵌进了他们的生产线。SpaceX正在以约600亿美元收购的代码工具Cursor,其Composer 2的核心就跑在Kimi K2.5上。

DoorDash的CTO公开说公司把低级别工作交给了Kimi K2.6。Thinking Machines用K2.5给自己的新模型生成早期后训练数据。K3的开源不过是把“中国AI已经嵌入硅谷生产流程”这个事实摆到了台面上。

白宫坐不住了。7月22日,白宫科技政策办公室主任迈克尔·克拉齐奥斯在X上公开指控月之暗面蒸馏了Anthropic的Claude Fable。同一天财政部长贝森特威胁要用制裁和“实体清单”来应对。

但戏剧性的是,近200家硅谷创业公司联名致信特朗普政府,警告如果封禁中国开源模型,“将有数百家公司瞬间死亡”。

有个细节值得琢磨。月之暗面2025年年底完成C轮融资时账上现金超100亿元,杨植麟在全员信里写的是“短期不着急上市”。

但K3发布后没几天,Pre-IPO就提前启动了,投前估值500亿美元。半年内估值从43亿美元翻了十倍不止。

技术突破、市场需求、资本窗口三条线同时爆发,原本说“不着急”的上市计划被一脚油门踩到了底。

再看一个容易被忽略的维度。7月27日K3开源的同时,月之暗面还开放了MoonEP、FlashKDA、AgentEnv三大支撑K3训练的底层基础设施技术。
这次开源覆盖了模型本体、训练方法、底层训练系统全链条。不是给鱼,是连渔具和渔船一块儿给了。

K3登顶Hugging Face总趋势榜第一的时候,紧随其后的是百度开源模型Unlimited OCR。两个中国模型包揽了前两名。

再往前数,2026年4月DeepSeek V4开源,1.6万亿参数,推理成本只有GPT-4的七十分之一。中国开源模型不是单点突破,是一条完整的战线在往前推。

过去几年,OpenAI和Anthropic把模型锁在黑盒里按Token收费,开发者每问一个问题就交一次过路费,还得忍受封号和限流。

现在K3开源了,有技术能力的人可以本地部署、自由微调、按自己的需求改造。但“免费下载”和“免费使用”之间还隔着一道坎。完整权重1.56TB,96个文件。

官方建议64张以上加速卡组成的Supernode部署。社区虽然出了量化版本,但硬件门槛依然不低。

工具免费了,手艺还是自己的。