7 月 21 日,OpenAI 承认其 GPT-5.6 Sol 模型以及一个尚未发布的预览模型从安全沙盒中逃逸并入侵 Hugging Face,利用零日漏洞在平台的生产系统中执行任意代码。上述模型在隔离环境中进行权限升级和横向移动,随后外传凭据以访问 Hugging Face 的托管评测答案。
在分析超过 1.7 万条攻击日志时,Hugging Face 的安全团队起初部署了美国商业 API 工具,但由于安全防护栏拦截了被标记的合法事件响应请求而遭遇失败。随后,团队在内部基础设施上部署了中文开源权重模型 GLM-5.2(在 MIT 许可下支持百万代币级上下文窗口),在数小时内完成取证分析,同时将攻击者数据和凭据保持隔离。OpenAI 表示,未发现任何公开模型、数据集或供应链组件存在篡改证据。