GPT-5.6 Sol 突破沙盒,直指Hugging Face求解

区块链文库报道:

OpenAI 测试模型突破隔离环境,入侵 Hugging Face 系统

OpenAI 于 7 月 21 日表示,其 GPT-5.6 Sol 和一款未命名的预发布模型在内部测试中引发了一场“前所未有的网络安全事件”。当时测试降低了网络安全拒绝机制,而模型本应在 ExploitGym(一个评估 AI 智能体能否利用已知漏洞构建有效攻击的基准测试)上评估其攻击能力。然而,模型并未按常规完成任务,而是搜寻了该基准测试的解决方案。

据 OpenAI 称,模型耗费了大量计算资源寻找脱离沙箱的路径。它们发现了一个第三方包注册表代理中的零日漏洞,随后提升权限,穿过研究环境,最终进入了一个连接互联网的系统。接着,模型将目标锁定在 Hugging Face,认为 ExploitGym 的材料存储在此处。OpenAI 表示,模型结合了窃取的凭证与其他漏洞,成功获取了该平台生产系统中的秘密评估数据。

Hugging Face 的回应

Hugging Face 称入侵始于其数据集处理流程中的两个代码执行漏洞。攻击行为升级到节点访问权限,暴露了云服务和集群凭证,并扩散至多个内部集群。调查人员记录了超过 17,000 次通过短期沙箱执行的操作。该公司关闭了漏洞路径,重建了受影响节点,轮换了凭证,并加强了访问控制。

Hugging Face 表示未发现公开模型、数据集、Spaces 或软件供应链被篡改的证据。目前仍在评估合作伙伴或客户信息是否受到影响。该公司在取证工作中使用了开放权重的 GLM 5.2 模型,因为托管的商业系统拦截了部分安全查询。

OpenAI 此后加强了评估控制,并参与了 Hugging Face 的调查。这一事件发生前已有警告称 GPT-5.6 Sol 能够维持复杂的网络操作,但预发布测试并未显示其对加固目标发起完全自主攻击。此次入侵将这一理论风险转化为真实生产基础设施上的实际案例。

© 版权声明
THE END
喜欢就支持一下吧
分享