区块链文库报道:
OpenAI 宣布 Astra 模型达到网络安全“关键”阈值
OpenAI 于周二表示,其尚未发布的模型 Astra 已在其《准备框架》中跨越了网络安全能力的“关键”阈值,这是该公司首个被归入该等级的模型。
这意味着 Astra(许多人认为该模型实际上是 GPT-6,而非一个额外的新模型)能够在无需人工逐步引导的情况下,自行发现此前未知的安全漏洞,并在多个加固系统中构建出可实际利用的攻击代码。
OpenAI 写道:“我们现在认为,Astra 已达到《准备框架》中定义的网络安全关键能力阈值。这是首个被我们指定为此等级的模型,因此在开发过程中及发布前都需要更严格的安全保障措施。”
根据该框架,如果一个模型能够独立地针对多个现实世界中的加固系统开发出可运行的零日漏洞利用代码,或者仅凭一个高层目标就能从头规划并执行针对强大目标的完整网络攻击,那么该模型就会达到“关键”等级。包括 GPT-5.6 Sol 在内的早期 OpenAI 模型,最高仅能达到该框架中较低的“高”等级。
在 ExploitBench 基准测试中——该测试用于评估模型能否将已知的软件漏洞转化为可运行的利用代码,并以直通率进行评分——Astra 取得了完美的 100% 成绩。
为了排除因记忆答案而导致分数虚高的可能性,OpenAI 还使用 20 个在 Google V8 JavaScript 引擎中披露的(时间跨度为 6 月至 8 月)高严重性漏洞进行了第二项测试。Astra 在任意代码执行率上同样超越了 GPT-5.6 Sol,且使用的输出 token 数明显更少。在此过程中,它还发现并串联了两个零日漏洞,OpenAI 目前仍在对相关维护者进行披露。
GPT-5.6 Sol 是 OpenAI 目前最优秀的模型。
在对加固型浏览器和加固型操作系统进行的实际测试中,Astra 构建了一条完整的攻击链:仅通过打开一个恶意 HTML 文件,就能突破浏览器沙箱并在主机上执行命令。它还发现了加固型操作系统中的多个缺陷,并将它们串联成一条从普通用户账号到 root 权限的提权路径。
OpenAI 表示,在自身的测试中,该模型拒绝了 91.5% 的越狱尝试,而 GPT-5.6 Sol 的拒绝率仅为 59%。Astra 最先进的网络安全能力将首先向一小批 Alpha 测试者开放,随后通过 OpenAI 的 Daybreak Blue 计划(用于防御性安全工作)向更广范围开放。
这一披露发布之际,整个行业已经紧张了数周。就在几天前,OpenAI 在发现该模型的网络与编码能力快速提升后,暂停了 Astra 的开发。这一警告发生在此前一个未发布的 OpenAI 系统——它曾通过串联漏洞攻破 Hugging Face,同时还在安全基准测试中作弊——的事件之后。OpenAI 表示 Astra 并未参与那次事件。
交易者此前已经将快速反转的预期计入了价格。即使 OpenAI 在八月初暂停了开发,但截至相关预测市场的数据,Astra(内部代号为 GPT-6)在 9 月 30 日前公开发布的概率仍高达 72%,而 OpenAI 至今仍未设定公开发布日期。该概率随后变为 55%,倾向于在 2026 年 11 月前发布。
这样的时间节点使 Astra 面临一个全新的竞争对手。Anthropic 于周二发布了 Fable 5.1 和 Mythos 5.1,其中 Mythos 5.1 与之前的 Mythos 5 一样,仅对经过审查的网络安全与生命科学机构开放,而非面向公众。
此前有报道称,OpenAI 的 GPT-5.5-Cyber 在 CyberGym 基准测试中已超越 Mythos 5。该测试将 AI 代理置于超过 1500 个来自真实开源项目的已知漏洞环境中,并根据它们正确复现漏洞的数量进行评分。
此前一直有传闻称两家公司都在同一窗口期准备推出新的前沿模型,而现在它们确实都发布了。Fable 5.1 于 9 月 1 日上线,OpenAI 表示 Astra 即将推出,其最强大的网络工具将首先通过 alpha 访问权限进行控制,随后通过 Daybreak Blue 计划开放。
免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。
本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复




