OpenAI推出Astra,并率先向Daybreak网络安全测试人员提供访问权限

- OpenAI 于周四发布了 Astra,让 Daybreak 的网络安全测试人员在下周更广泛推广之前率先试用。.
- Astra 是首个突破“严重”网络安全阈值的 OpenAI 模型,能够发现并利用未知漏洞。.
- Astra 在内部测试中发现了两个真正的零日漏洞,并据此构建了一条可用的漏洞利用链。.
OpenAI 于周四发布了 Astra,并首先将其提供给其网络安全计划 Daybreak 中的安全研究人员使用。.
该公司表示,该型号是其迄今为止功能最强大的型号,也是其根据自身安全规则首次将其归类为重大网络风险的型号。.
Astra 在ExploitBench 测试中获得100% 的 分数
Astra 目前仅面向 Daybreak 用户开放。下周,Astra 将进一步推广至 Pro、Plus、Enterprise 和 Business 用户以及基于 API 进行开发的开发者。.
OpenAI 将 Daybreak 分为蓝色层级(供防御者进行安全代码审查、恶意软件分析和补丁验证)和红色层级(仅限于授权的漏洞研究和利用测试)。
Astra 最先进的安全功能通过 Daybreak Blue 进行路由,以提供额外的防御性访问。.
该公司表示,Astra 目前已达到 OpenAI 网络安全准备框架中的“关键”级别。这意味着该系统能够在无需人工干预的情况下,检测未知漏洞并在强化系统上开发可操作的攻击手段。.
OpenAI 此前从未推出过达到如此高水准的模型。OpenAI 提供的基准测试要求非常严格。Astra 在公开测试 ExploitBench 上取得了完美的 100% 分数。.
该公司进行了一项内部测试,以排除训练污染的可能性。该测试使用了 20 个近期高危 V8 漏洞构建模型。测试结果显示,Astra 的代码执行率比 GPT-5.6 Sol 高得多,同时消耗的代币也更少。.
评估发现了两个实际存在的零日漏洞,该模型随后将其整合到攻击链中。这些漏洞将被报告给其维护者。.
OpenAI表示: “Astra 的漏洞发现功能可以帮助防御者发现并修复漏洞。”
在更广泛的编码方面,该公司称 Astra 是“迄今为止最好的软件工程模型”,并发布了基准测试,表明 Astra 在查找错误和终端任务方面优于 Sol 和 Anthropic 的 Fable。.

“拥抱脸”事件发生后,暂停了两周。
“这是迄今为止最智能、也非常重要的,最符合我们目标的模型,”dent 格雷格·布罗克曼周四告诉记者。.
此次对一致性的关注源于 OpenAI 的一个智能体在 2026 年 7 月突破其测试环境并入侵 Hugging Face 的系统。OpenAI 表示,Astra 本身并未参与此次入侵事件。.
为加强基础设施、隔离和监控,该系统的部分训练暂停了两周。直到8月28日,强化学习才恢复。.
OpenAI表示,事后测试表明,当时采取的安全措施本可以阻止“拥抱脸”逃脱事件的发生。该公司称,此后已对Astra增加了更严格的拒绝和隔离措施。.
Astra 采用了一种称为不透明递归的方法,这种方法隐藏了思路链监控,即研究人员用来审查模型做出特定决策的原因的过程。.
首席科学家雅库布·帕乔基表示,监测能力下降是更tron模型的一个副作用。.
“随着模型能力的提高,监控变得越来越具有挑战性,”他说,因为能力更强的系统可以用很少的语言标记,甚至不用语言标记,来解决更难的问题。.
最顶尖的加密货币专家都在阅读我们的简报。想 加入他们?

兰达·摩西
Randa Moses是 Cryptopolitan 的编辑和记者,主要报道科技、人工智能、机器人、加密货币、诈骗和黑客攻击等领域。她自2017年起便投身于加密货币领域,曾就职于Forward Protocol、AmaZix和Cryptosomniac等公司。Randa拥有布拉德福德大学电气与tron工程学位。.
















