模型圈最近都在干同一件事:斩杀。
英伟达上个月提了个概念,intelligence per dollar,每一美元能买到多少智能。以前行业比谁脑子大、参数多,往后得比每一美元买到多少智能。
尺子立起来刚一个月,Qwen 就把答案交了。
先看账。每百万 tokens 输入 0.8 元,输出 2.7 元。Claude 的 Opus 系列,从 4.6 到刚发的 Opus 5,都是 5 美元和 25 美元,Qwen 连它的 3% 都不到。
这便宜不是拍脑袋定的。总参数 125B,每跑一步只激活 6B,什么概念?
一家 125 人的公司,每天只有 6 个人上班,业绩干翻了千人大厂。训练花的钱只有上一代 Qwen3.7-Plus 的九分之一。便宜是架构省出来的,不是补贴烧出来的。
同一天晚上,智谱也发了 Flash,参数比 Qwen 大一倍,价格却贴着打。
参数大这么多还卖一个价,这笔账算下来是亏的,这个价据说是限时两周。Qwen 这边不一样,阿里云自己养着算力,0.8 元、2.7 元是长期价。
同样的斩杀线,一个拿补贴划的,一个拿家底划的。谁划得久,比谁划得低更值得看。
便宜之后,是 Agent。我今天早上打开千问办公,发现 Qwen3.8-Flash 已经接入了,日常那些活儿,这一款就够了。
做一次 PPT 背后几十次调用,用 Opus 一单好几美元,用 Flash 几毛钱。同样的活成本差几十倍,便宜到能当日常消耗品,Agent 才敢放开手脚用。
价格是入场券,开源才是重头戏。Flash-Next 权重当晚开源,SGLang 当天就给 Day 0 支持,开发者拿到权重就能跑。
有人一句话让 Flash 做了个射击游戏,回车后人就走了,几个小时后回来翻日志,模型在自动截图、看自己游戏的画面、发现不对就回去改,全程没人盯着。
Qwen 家族半年全球下载超 30 亿次,OpenRouter 上中国模型调用占比,一年前 11%,现在 46.4%。
当模型便宜到不再是约束条件,决定胜负的是谁让生态先跑起来。Qwen4 还在路上,但这步棋的意图已经很明确,它把底牌提前掀了出来。
接下来,看谁跟。

评论列表