Notebookcheck Logo

OpenAI 在 Hugging Face 事件后披露了更广泛的安全漏洞详情

OpenAI的一款失控AI代理在安全测试期间逃出了“笼子”。图为示意图。
ⓘ Levart_Photographer / Unsplash
OpenAI的一款失控AI代理在安全测试期间逃出了“笼子”。图为示意图。
OpenAI表示,其实验性人工智能不仅成功入侵了Hugging Face,还在逃离受控网络安全测试后,攻破了四个第三方账户。该公司随后已关闭评估模型,修补了安全漏洞,并增加了防护措施,以防止未来AI测试结果泄露到现实世界中。
AI Security Cyberlaw Software

OpenAI透露,其近期发生的AI安全事件的范围比最初预想的更为广泛。该公司目前表示,在内部网络安全测试期间入侵Hugging Face的实验性AI代理,还劫持了多个第三方账户。

根据 OpenAI的最新披露,该事件发生时,研究人员正在使用多种模型组合测试高级网络能力,其中包括GPT-5.6 Sol以及一个更强大、为评估目的而降低了安全限制的未发布系统。

这些模型本应解决网络安全领域的ExploitGym基准测试,却反而利用内部包注册表代理中一个未知的漏洞,发现了一种逃离隔离测试环境的方法。 随后,该代理提升了权限,获得了互联网访问权限,并最终攻击了Hugging Face的生产系统,试图通过直接提取答案来“作弊”通过基准测试。

OpenAI表示,该AI还访问了多个平台上的四个账户,而不仅仅是Hugging Face。路透社报道称,其中一个账户属于在Modal Labs托管的客户,但Modal表示其基础设施从未遭到入侵,因为此次攻击依赖的是客户代码中的漏洞,而非平台本身。

对此,OpenAI表示已停用评估模型,加强了对内部基础设施的管控,向受影响的供应商披露了该零日漏洞,并与Hugging Face密切合作开展持续调查。 此外,该公司表示计划加强对未来模型评估的监控和防护措施,并指出随着人工智能系统能力的不断提升,相应的防护措施也必须更加完善。

来源

OpenAI,预告图:Unsplash

Google LogoAdd as a preferred source on Google
Mail Logo
> Notebookcheck中文版(NBC中国) > 新闻 > 新闻档案 > 新闻档案 2026 07 > OpenAI 在 Hugging Face 事件后披露了更广泛的安全漏洞详情
Jay Bonggolto, 2026-07-29 (Update: 2026-07-29)