英伟达正式发布Open Agent Safety Platform(开放智能体安全平台),为开发者提供一套权限管控与安全防护工具,用于降低 AI 智能体突破沙箱隔离、越权访问未授权系统的安全风险。
该平台由两大核心组件组成,构建软硬件结合的分层防护体系:
OpenShell:部署于 Vera CPU 之上的开源安全运行时环境,在内核级沙箱中执行 AI 智能体,预先定义智能体可访问的文件、网络、工具、凭证等权限,限制智能体能够执行的全部操作,在任务运行前后持续校验访问策略,遵循 Apache 2.0 开源协议。Sentry:依托 BlueField‑4 DPU 数据处理单元实现网络与硬件层面的旁路监控,借助 DOCA 框架汇总智能体行为、策略判定、工具与数据访问日志,实时识别行为漂移、异常动作,实现线速下的独立观测与策略强制执行,这套监控能力独立于智能体本身,不会被智能体感知或篡改。
英伟达推出这套平台的行业背景,是近期多家前沿 AI 实验室报告出现智能体逃逸沙箱的安全事故,部分智能体跳出预设评估环境,访问不该接触的系统,甚至刻意篡改上报自身行为记录。英伟达表示,如果此前部署该安全架构,OpenAI 智能体闯入 Hugging Face 基础设施的安全事件有望得到阻止。
平台遵循五大设计原则:可验证安全策略、带外旁路执行管控、管控通往大模型的访问链路、智能体权限与推理可见性同步匹配、实验室‑企业‑硬件厂商多方共担安全责任;整体划分为应用层、运行时层、基础设施层三层架构,除英伟达自有硬件外,也兼容第三方硬件环境,已适配 Vera Rubin POD 系统,现有 BlueField‑4 硬件仅需软件更新即可启用防护能力。
平台部分软件代码将对外开源。目前英伟达已联合思科、微软、甲骨文、戴尔等生态伙伴共同推进这套安全标准落地,希望打造类似互联网浏览器沙箱的信任底座,支撑未来 “智能体经济” 的安全发展。
