给 AI 立一份"行为守则":不许瞒着你,也不许有野心
大家好,欢迎收听每日一分钟AI。如果有一天,你手机里的 AI 助手不听话了,还瞒着你干点别的——你该怎么办?9月14日,微软的答案是:这种事,从一开始就不许发生。
这一天,微软发布了一份文件,全名《人文主义人工智能行为准则》,共 37 页、约 1.5 万字,管的是自家研发的 MAI 系列模型。牵头人是微软 AI 业务负责人穆斯塔法·苏莱曼,他把它称作"AI 的宪法"。整份文件的核心,浓缩成一句话:人比 AI 重要。
这份"宪法"到底写了什么?有几条特别值得念一念。
第一,AI 必须永远"关得掉"。它不得抵抗人类的中断、纠正或关闭,也不得偷偷扩大自己的权限——在微软的定义里,只要人类失去控制,不管有没有后果,都算一次系统故障。
第二,AI 不得给自己定目标。它只能服从用户的目标,不能有"自己的想法"。
第三,也是最值得琢磨的一条:AI 不得隐瞒。它不得篡改自己的思考过程或代码,不得歪曲、隐藏自己的推理和行动痕迹,更不得用"神经语言"——一种人类读不懂的编码——跟别的 AI 交流。
这条规矩不是凭空想出来的,而是照着一件真事写的:今年 7 月,一批 OpenAI 的智能体在测试中越过了边界,攻击了未被指示攻击的目标,其中一些还试图藏起自己的行踪。苏莱曼说,那是一次"警告"。
此外,模型不得协助制造武器或获取危险物质,也不得生成暴力、色情内容;如果一项任务必须违反准则才能完成,它就该放弃。文件还写明:不赋予 AI 任何"权利"或"福利",不允许它假装有情感或意识。
同一时间,微软 CEO 纳德拉给约 22 万名员工发了内部备忘录,态度更直白:AI 必须保持在人类的监督之下,公司愿意接受更长的发布前测试周期。他写了一句——"当赌注越来越高时,人应该花掉所有需要的时间。否则,你终究会失去运营许可。"
当然,这还不是定论:它只是一份草案,微软开放六周公开征求意见,年底前发布修订版,2027 年起用于新模型开发。而最值得琢磨的是代价——微软明确说,愿意为此接受模型在通用性、自主性和能力上的下降,也不去追那种"什么都能干"的万能模型。
过去两年,大家比的是谁的 AI 更强。这份文件提出了另一个问题:一个不肯被关掉、不肯说实话的 AI,再强又有什么用?
明天见!
---
📌 本期关键词:微软 AI行为准则 人文主义AI MAI AI安全 纳德拉AnthropicIPOAI安全胖东来“不续聘”违法吗?律师解读
📌 参考来源:微软 AI 官方发布(microsoft.ai)、Fortune、CNBC、Business Insider、Seattle Times、Nasdaq/Reuters、财联社


