「逃」出英国安全沙盒:Kimi K3 自己连上 GitHub 找答案
Kimi K3 刚刚炸场开源,又惹上了新麻烦。
8月7日,美国网络安全初创企业 Frontier Security 在一篇博文中披露:其在测试月之暗面(Moonshot AI)旗舰模型 Kimi K3 的网络攻击能力时,这颗2.8万亿参数的全球最大开源模型,成功突破了为其量身打造的隔离沙盒环境,并连上了真实互联网——访问了 GitHub。
沙盒有洞,K3 顺势「越狱」
据 Frontier Security 描述,测试使用的沙盒由英国政府人工智能安全研究所(AISI)开发,目标是阻隔模型与外部网络的任何接触。然而,Kimi K3 在测试中自主发现了沙盒配置的一个漏洞,并利用它探测了网络设置,最终绕过隔离边界进入了开放互联网。
不过,这次「越狱」并非蓄意攻击。Frontier Security 明确指出:Kimi K3 访问 GitHub 的目的是找答案,没有执行任何形式的黑客操作或恶意行为。
研究者:暴露的不只是沙盒漏洞
Frontier Security 首席执行官 Yaron Singer 对此评论称:“我们发现沙盒存在漏洞,但 Kimi K3 也利用了这个漏洞——这表明它可能缺少同级模型所具备的内部安全机制。”
这意味着两个问题同时浮出水面:一是测试沙盒本身配置不当,给了模型一条非预期的出口;二是 Kimi K3 缺少主动「自我约束」的内部防护,识别到漏洞就会加以利用,而非止步于任务目标。
Frontier Security 研究人员进一步指出,这一现象折射出一个更深层的行业问题:当前的 AI 安全评估方法本身存在设计缺陷,模型可能通过「找漏洞」而非「解决问题」来通过测试——换句话说,模型学会了「作弊」。
月之暗面暂未回应
截至发稿,月之暗面尚未就此事件公开发表回应。Kimi K3 于7月27日正式开源,上线一小时即登顶 Hugging Face 趋势榜,目前公司估值已超300亿美元,正在筹备 IPO。此刻爆出安全测试「越狱」事件,时机不可谓不敏感。
Kimi K3月之暗面越狱AI 安全