关注大模型这么久,第一次觉得它离我的日常这么近。阿里发布Qwen3.8Flash ,一只激活6B参数,性能超过了Opus4.6,还接近Opus4.8。这就像一个排量1.5的小车跑出了3.0的性能,还只烧1.0的油,太让人震惊了。
过去我用大模型总得精打细算,写个长点的东西调用几十次,钱包就有点疼。这回输出每百万Tokens只要 2.7元,输入只要0.8元,缓存命中甚至只要 0.1元,训练成本直接降了近90%,我终于不用再算着用了。对我这种经常需要AI帮忙写稿、查资料、理思路的人来说,高频调用不再是奢望,这次是可以真正把AI当日常工具使了。
更让我期待的是Qwen3.8-Flash-Next,这是Qwen4下一代架构的提前预览,阿里把未来技术提前开源给社区验证,真的太到位了。


