昊梵体育网

阿里放大招:Qwen3.8-Flash 把训练成本砍掉 90% 8 月底,阿里通

阿里放大招:Qwen3.8-Flash 把训练成本砍掉 90%
8 月底,阿里通义千问正式开源 Qwen3.8-Flash 模型,一组数字让整个大模型圈坐不住了:
总参数 125B,激活参数只有 6B——这是典型的混合专家(MoE)架构,但极致到了"激活比 5%"的级别。
更狠的是成本:在多项智能体和编程基准上表现优异的同时,训练成本较上一代下降近 90%。
1000 万降到 100 万,量级上的跨越。
架构上也有新东西:采用 GDN 和 QSA 混合注意力,兼顾效率和长文本能力。原生 262K 上下文,可扩展到 100 万 tokens。
定价也打到底:QwenCloud 上 0.16 美元/百万输入 tokens,0.47 美元/百万输出 tokens——比国际同类闭源模型便宜一个数量级。
一句话总结:阿里这次不卷"参数第一",直接卷"性价比第一"。
推理单价打下来,应用层才有空间。当一次 AI 调用的成本从 1 毛钱降到 1 分钱,能跑通的商业场景会多出几十倍。
国内大模型从"秀肌肉"到"卷落地",Qwen3.8-Flash 是一个清晰的拐点。
接下来就是看哪家应用厂商先用这么便宜的模型,做出真正赚钱的产品了。