现在官微出来了。
benchmark 跟昨天看到的一致。
而且随着 DeepSeek V4 全系列模型正式版上线,我们将对 API 价格进行更新调整。
对于公开基准测试集中的 Code Agent 任务,DeepSeek-V4-Pro-0813 使用 DeepSeek Harness 极简模式作为框架进行测试(使用 max 档位,topp=0.95,temperature=1.0),其他框架下结果可能略有不同。
为了更加合理地调配资源,我们将采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。


