据《The Information》报道, 张一鸣 7 月在 Seed 团队内部会议上明确:字节跳动不会依靠蒸馏其他前沿模型来快速提升自研能力, 即使可能导致现阶段落后于国内竞争对手。
张一鸣过去很少在 Seed 团队会议上发言, 这次罕见开口, 原话是「应该愿意为长期目标牺牲一部分短期收益」。同时ZF 独家补充了两个细节:字节对蒸馏的限制涵盖开源模型——通过 API 检测等方式在内部强制执行; 核心考量是技术路线判断(团队认为蒸馏会干扰长期技术突破), 地缘政治避险只是附带的。
字节当前的处境给这个选择提供了注脚。旗舰大模型 Seed 2.1 Pro 没有被收录进 Artificial Analysis 榜单, 在 Arena AI 网页开发编程榜排第 19, 明显落后于其他中国模型。字节几乎是中国主要 AI 公司里唯一大语言模型基本全闭源的一家。部分员工认为, 不愿蒸馏是字节 LLM 落后于阿里、DeepSeek、智谱和月之暗面的重要原因。
但字节在 AI 视频生成领域(Seedance 2.0)是全球领先者——同一家公司, 两条赛道, 两种位置。
行业背景也值得提一句。月之暗面 Kimi K3 发布后, 一名白宫高级官员公开指责其蒸馏美国前沿模型; Anthropic 曾指控多家中国 AI 公司大规模蒸馏 Claude。蒸馏已成中美 AI 竞争里最敏感的议题之一。但 DeepSeek 的 MLA 架构创新、MoE 路线带来的成本优势, 这些能力无法靠蒸馏复制。
张一鸣选了一条慢路。昨天 DeepSeek 刚登顶 OpenRouter 全球第一并宣布 API 涨价——一家用开源加低价拿到全球最大负载, 一家拒绝蒸馏靠自研追赶。两条路线的代价和回报, 接下来几个月会继续兑现。持续静观其变。
张一鸣 字节不走模型蒸馏捷径字节跳动AI模型蒸馏

