DeepSeek V4-Flash霸榜全球调用量第一,中国模型包揽前五其四,开发者集体"叛逃"美国AI?
OpenRouter最新周榜出来了,看完我直接愣住——全球大模型调用量前五,中国占了四个,DeepSeek V4-Flash稳坐第一,连续霸榜。更狠的是,中国模型整体token占比已经破60%,把美国模型甩出快一倍。
这背后到底发生了什么?
说白了就一个字:钱。
Qwen3.8-Flash的定价,只有Claude Opus 4.6的3%。注意,不是30%,是3%。
什么意思?你跑一个编码任务,用Claude烧掉100块,用Qwen只要3块。效果呢?在编程、工作流、Agent这些"吃token大户"场景里,差距小到可以忽略。当单次任务从几千token飙到几十万token,成本差距就从"忽略不计"变成了"每月省出一台iPhone"。
OpenRouter的数据不会骗人——这平台上47%用户是美国开发者,中国用户只占6%。也就是说,是美国程序员自己在疯狂调用中国模型,不是咱们刷出来的。
三个真相要认清:
1. 调用量≠技术碾压,但等于"性价比碾压"。Claude和GPT在复杂推理上依然很强,但开发者不是做科研,是做生意。同样效果省90%成本,傻子都知道怎么选。
2. 编程和Agent才是主战场。OpenRouter上编程任务token占比从2025年初的11%涨到现在50%以上。中国模型恰好在这两块卡位最准——DeepSeek的代码能力、Qwen的长文本、MiMo的多模态,全是开发者刚需。
3. "免费换市场"是阳谋,但阳谋正在见效。DeepSeek V4-Flash免费开放,MiniMax、腾讯HY3送大量额度。先用免费把开发者圈进来,再靠效果把人留住。等美国模型降价80%追上来,开发者已经换完代码库了。
a16z合伙人去年说过一句话:硅谷80%用开源栈的初创公司,底层跑的是中国模型。当时很多人觉得夸张,现在看,保守了。
但这事也有另一面要警惕:调用量高不代表收入高。中国模型18万亿token里,多少是付费、多少是免费额度,没人知道。Claude每一笔调用都在收钱,中国模型很多在"做慈善"。
烧钱换份额能烧多久?这是所有国产大模型迟早要答的题。
你觉得国产大模型是靠"真本事"赢的,还是靠"价格战"偷的家?如果Claude明天也降到跟Qwen一个价,你会切回去吗?
DeepSeek 国产大模型 AI编程 OpenRouter
