昊梵体育网

DeepSeek V4 Pro 正式版深夜突袭!Agent 能力暴涨50分,价格

DeepSeek V4 Pro 正式版深夜突袭!Agent 能力暴涨50分,价格却还在地板
你是否还记得,2025 年那个冬天,DeepSeek R1 横空出世,让全世界见识了"来自东方的神秘力量"?
一年多过去,8 月 13 日凌晨,DeepSeek 又干了一件"不讲武德"的事——没有发布会、没有倒计时、连更新日志都没来得及写好,V4 Pro 正式版就这么悄悄上线了。等大家睡醒,社区已经炸开了锅:那条"大鲸鱼",补上了最后一块短板。
从 4 月 24 日预览版算起,这一等就是 111 天。今天咱们就聊聊,这版 Pro 到底强在哪,值不值得你连夜切换?
一、Agent 能力暴涨,数字像开了挂
先说硬参数:1.6T 总参数、49B 激活的 MoE 架构没变,1M 上下文、384K 最大输出也没变。变的是后训练,变化大到像换了个模型。
最夸张的是 Agent 相关评测,几乎全线翻倍:
· DeepSWE(软件工程基准):12.8 → 62.7,暴涨近 50 分
· Cybergym(网络安全攻防):52.7 → 83.3
· Terminal Bench(终端操作):72.1 → 87.9
· DSBench-Hard(高难编码):翻了一倍多,达到 67.2
官方口径:多项 Agent 评测已接近 Claude Fable 5 等第一梯队。换句话说,之前"让 AI 帮你干活容易翻车"的毛病,这版基本治好了。实测里,让它在 Canvas 上写一个 200 只三角形群体模拟,170 秒、761 行代码,一次跑通。
二、第一次长了"眼睛"
预览版是纯文本模型,正式版首次原生支持图像推理。DeepThink 引擎现在可以在同一个思考流程里看图片、读截图、处理混合文档。对"看图干活"的 Agent 场景来说,这是从 0 到 1 的突破。
三、一套代码,通吃两大生态
正式版支持 OpenAI 的 Responses API,还兼容 Anthropic API——把 BASE URL 换成 api.deepseek.com/anthropic,就能接入 Claude Code 生态。开发者不用改配置,模型名还是 deepseek-v4-pro,之前写的代码直接切过来。
四、价格还是地板,但窗口期不多了
每百万 token 输入 3 元、输出 6 元,缓存命中更是低到 0.025 元。对比一下:GPT-5.6 系列输出 30 美元/百万,差了 30 多倍;只有 Kimi K3 的三分之一左右。
不过要提醒一句:8 月 6 日 DeepSeek 已预告"近期整体上调 API 定价,涨幅较大"。目前 0813 版本还没动,这波低价窗口能撑多久,真不好说。想薅的,趁早。
五、翻车点也真实存在
实测有个坑:开着 thinking 模式写复杂代码,推理 token 能占到输出的 80% 以上,代码写到一半被截断。关掉 thinking 重跑,54 秒就输出了 715 行完整代码。所以大段代码任务,记得主动关思考模式,或者拉高 max_tokens 兜底。
六、背后还有一盘大棋
藏在更新日志里的一行小字:评测用了"DeepSeek Harness 极简模式(即将发布)"。这家公司正在把"大脑 + 手脚 + 工具箱"打包成一个真正能替你干活的系统。竞争已经从"谁的模型更聪明",打到了"谁能把任务完整交付"。
结语
V4 Pro 不是一张"全面碾压"的成绩单——纯知识推理和最复杂的任务,它还没坐上头把交椅。但 DeepSeek 的定律从来没变过:比我强的没我便宜,比我便宜的没我强。
当 Agent 能力从"几乎不可用"涨到"能跟闭源旗舰正面对打",这条定律的杀伤力,比预览版时期大了整整一个量级。
那么问题来了:你现在的主力模型是哪个?V4 Pro 这波升级,会让你换队吗?评论区聊聊,我等你!🚀