ds大超预期,v4 Flash正式版能力逼近opus 4.8,看好26H2国产模型加速成长
能力:基准测试远超 V4-Pro-Preview。DeepSeek V4 Flash 正式版作为284b小模型跻身国产开源Agentic模型第一梯队。Agent编程测试中领先GLM-5.2,弱于k3;看海外,Agent Coding能力已接近GPT-5.6 Luna,综合能力略低于Opus 4.8、Luna,进一步低于Terra和Sol。
价格:推理价格只有 V4 Pro 的三分之一、GPT-5.6 Luna的1/3(降价后)、Terra的数十分之一、Sol和Opus的~1/100,延续国产模型极致性价比优势。
实现路径:V4 Flash与V4 Pro属于同一代、同一技术路线,架构范式差别不大。CSA+HCA、mHC和超大MoE构成的V4底座具备较高智力上限,但首版后训练和Agent Harness尚未充分释放其能力,补齐后训练后能力大幅释放,我们认为,V4 Pro正式版会更值得期待。
考虑v4的超预期提升,我们核心观点:1)重申看好国产模型下半年的国产模型百花齐放, 重点关注国产链。因为这背后本质是国产的模型在严肃办公场景进入“好用”这一跨越带来的,价格有极大优势,且能力进阶的引发的真实需求。2)模型智力提升,而单价大幅降低, 更优质的供给带来下游更充裕的应用需求。从Coding到Cowork,看好有基本面软件公司受益ai带来的增量需求,建议关注成长性30%+,同时叙事变化标的。