OpenAI Astra模型首次达到「关键」网络安全阈值,将限制高级功能访问
OpenAI宣布Astra模型已跨越「关键」网络安全阈值,在ExploitBench上取得100%成绩并发现2个零日漏洞。出于安全考量,最先进的网络安全功能将限制于一小部分测试人员使用。
OpenAI 宣布其最新模型 Astra 已正式跨越"关键(Critical)"网络安全阈值,成为首个被指定为该级别的 OpenAI 模型。
根据 OpenAI Preparedness Framework 的评估,Astra 在 ExploitBench 上取得 100% 的成绩,并在测试过程中发现了 2 个零日漏洞,且将其作为攻击链的一部分。
出于安全考量,OpenAI 表示将把最先进的网络安全功能限于一小部分测试人员使用,暂不全面开放。这体现了 OpenAI 在模型能力提升与安全管控之间寻求平衡的策略。
Astra 是 OpenAI 指定的第一个达到其关键网络安全能力阈值的模型。这一里程碑标志着大语言模型在网络安全领域的能力达到了新的高度,同时也引发了关于 AI 安全能力的访问控制和负责任部署的讨论。
值得注意的是,Anthropic 在同日发布了 Fable 5.1 模型,而 OpenAI 也于同日预告了 Astra 模型即将推出,但拒绝透露具体时间表。两大 AI 巨头在同一天均有重磅动作,竞争态势愈发激烈。
信息来源:InfoQ、网易科技(2026-09-02)
文章回复
0 条公开回复