昊梵体育网

DeepSeek V4 Flash 上周调用量 7.22 万亿 Token, 登

DeepSeek V4 Flash 上周调用量 7.22 万亿 Token, 登顶 OpenRouter 全球第一。单 8 月 1 日一天跑了 8 万亿 Token, 其中 5 万亿是免费额度、3 万亿是开发者付费。榜单前五里中国模型占四席——第二位小米 MiMo-V2.5、第三位腾讯混元 Hy3、第四位 V4 Flash 0731, 唯一的非国产席位是 OpenAI 的 GPT-5.6 Luna。

把这件事放到参数表里看会更清楚。V4 Flash 总参数 284B, 激活参数 13B。13B 是当下大多数闭源主力模型的体量, 但 V4 Flash 用 13B 的算力预算撬动 284B 的能力储备——MoE 路线「小数撬大数」的核心承诺, 第一次被推到全球第一的负载级别。

「想象一下 V4 Pro」——这是微博上讨论 V4 Flash 时反复出现的一句话。V4 Pro 同样在榜上, 上周 2.97 万亿 Token, 排第六。

成本侧有个更直观的对照。亚马逊一名工程师程序出 bug, Claude 跑了五个月无人监管, 烧出 180 万美元账单。同样的复杂任务——把一本书变成内容资产、做知识卡片、写公众号排版工具、做编辑部会诊、从零写光线追踪渲染器——拿 V4 Flash 跑一遍, 1 块钱。

一年半前 DeepSeek 爆火, 一夜之间英伟达跌近 17%、市值蒸发近 6000 亿美元。当时大家讨论的还是训练成本: 600 万美元 vs OpenAI 每年 50 亿美元+。那是「训练侧的成本革命」。

现在 V4 Flash 把这件事推到「推理侧」了——一边是全球第一的调用量, 一边是 1 块钱跑 5 个复杂任务。训练的省、推理的省、模型能力的强, 三件事在 2026 年下半年同时成立。

但热闹里也有分化。小米 MiMo-V2.5 环比下滑 52%, Kimi K3 跌出前十排到第十二, 智谱 GLM5.2 也在回落。中国大模型周调用量 28.13 万亿 Token, 环比下滑 14.76%, 但美国同期涨了 87.18%——总量美国仍只有 4.38 万亿, 中国是美国的 6.4 倍, 连续十四周领先。全球独立开发者市场已经白热化, 一次版本更新守不住优势, 节奏一慢流量就掉。

AI 这场仗, 第一阶段拼谁先做出来, 第二阶段拼谁便宜, 现在进入第三阶段——拼谁能持续迭代、持续控制推理成本。

DeepSeek让英伟达市值一夜蒸发4万亿DeepSeek V4激活参数只有13bDeepSeekV4一块钱生成的星舰