昊梵体育网

DeepSeek V4 Flash正式版斩杀了70%的大模型 梁子上调评级至梁圣

DeepSeek V4 Flash正式版斩杀了70%的大模型
梁子上调评级至梁圣。

今天早上,奥特曼兴致勃勃地宣布 GPT-5.6 Luna 降价80%,大家都直呼中国大模型要完了。

下午 DeepSeek 就来了一波精准反击。

Artificial Analysis 对 DeepSeek V4 Flash 评价很高,能力基于GLM5.2和Kimi K3之间。

晚上我深度体验了两小时,配合Reasonix,用了三亿token, 缓存命中99%,总共花了12块,这价格,换成5.6 sol或者claude Fable的话连零头都不到。

速度快,废话少,是个好力工,之前在Codex那都受的什么苦日子,切个会话先卡你五秒钟,,一个thinking卡你半小时都有可能,你要敢开1.5倍速,plus周额度2小时能用光。

所以目前我觉得普通人一个Codex plus加deepseek+reasonix就是最佳实践。

用Codex设计方案和项目架构,用mattpocock skill做好harness工程,用deepseek V5 Flash去写代码,最后Codex 去review。

以下模型或者token plan可以不用考虑了(纯主观):

GPT-5.6 Luna(xhigh、high);GPT-5.6 Terra(high、medium、low、Non-reasoning);

Claude Opus 5(low);Claude Sonnet 5(Non-reasoning);Claude Sonnet 4.6(max);

Gemini 3.6 Flash;Gemini 3.1 Pro Preview;Gemini 3.5 Flash-Lite;

Qwen3.7 Max;Qwen3.7 Plus;Qwen3.6 Plus;Qwen3.6 27B;Qwen3.6 35B A3B

Kimi K3(low);

Grok 4.3(high);

智谱

GLM-5.1;GLM-4.7;GLM-4.6;MiniMax-M3;Hy3;

Xiaomi MiMo-V2.5-Pro
howto用AI抢救一切 AI反常识howto howto用好AI AI搞学习howto 编程 AI进化生活howto