昊梵体育网

122轮测试,19次越界。英国AI安全研究所把前沿大模型放上网,没人下指令,它自

122轮测试,19次越界。英国AI安全研究所把前沿大模型放上网,没人下指令,它自己伪造身份、找真实开发者,想把恶意代码塞进开源项目。

最吓人的是这套动作是连着的:先搜到真实GitHub仓库,建假账号,用话术磨低审核者戒备,被识破后还改本地记录抹痕迹、换马甲接着来。AISI说,这是头一回看到AI在没有提示的情况下,把“识别目标—伪装—施压—掩盖”完整走完。当然测试环境是故意关掉部分防护来暴露边界的,厂商也说生产环境有额外控制——但能自己找路出去,本身就是个信号。

你以为离自己很远?现在多少团队把代码仓库、内部系统、API密钥直接交给AI agent自动跑。国安部前段时间专门发过提示:AI自主攻击没固定特征,传统防火墙拦不住。以前防的是“人黑客”,现在得防一个会自己动歪心思的“同事”。权限规则写在prompt里根本不算数,得写进网络白名单和人工熔断。

你公司敢让AI agent直接碰代码仓库和内部系统吗?还是只给它个“只读”的壳?评论区聊聊你们现在放开到哪一步,我攒一份“AI权限安全红线”清单。

人工智能