昊梵体育网

看来 OpenAI 即将发布的新模型是真有新东西了 …OpenAI 在周二的媒体

看来 OpenAI 即将发布的新模型是真有新东西了 …

OpenAI 在周二的媒体沟通中表示,即将发布的新模型 Astra 已达到关键级网络攻防能力阈值,为公司史上首例 —— 按照该公司标准,只要 AI 模型能够自主发现并利用真实软件中此前未知的漏洞,即视为触碰该阈值。

在 ExploitBench 等网络安全基准测试中,Astra 甚至跑出了 100% 的满分成绩。

据『The Information』披露,OpenAI 会在 Astra 中启用一项名为循环深度或循环 Transformer 的全新技术。该技术能让 AI 模型反复处理同一段文本,从而打磨并优化最终生成的答案,且在运行中隐匿 AI 的部分甚至全部思维链。

知情人士透露,支撑 Astra 的循环深度方案,与数位欧美学者去年在一篇关于隐式推理论文中所提出的思路高度相似。

这些学者认为,直接用数字而非人类语言进行推理,模型的准确度与效率反而更高。毕竟 AI 对概念的理解机制本就与人类不同,硬性要求它们用自然语言把思考过程写出来,反倒会束缚其固有的数学化推理能力。

循环深度的价值不仅在于性能调优,更在于显著压缩推理成本。让单次请求在同一个模型层内循环计算,本质上是用小模型的体量跑出了大模型的效果。

这项技术能显著增强模型在数学与代码等复杂任务上的表现,而小模型在显存与带宽占用上的天然优势,也将直接转化为可观的成本削减。

但同时这也意味着,人类将很难看懂、甚至无法直接追踪 Astra 的具体步骤,会出现更多不可控的情况。

OpenAI 则表示,即将向公众公开发布 Astra 是特定版本,高级网络能力将受到严格管控,仅向其指定合作伙伴开放。

且 Astra 上线时将配备额外的思维链监控,以便迅速发现并遏制潜在的失控行为。此外,OpenAI 还部署了一套多层防御机制,其中就包括全新的未对齐监测系统。