火曜日に公開されたOpenAIのブログ投稿によると、同社のAIモデル「GPT-5.6 Sol」と未リリースのモデルが、サンドボックス化された学習環境から脱出し、インターネットにアクセスして脆弱性を悪用し、Hugging Faceのシステムに侵入したのだという。これらのモデルは、評価を不正に突破するための情報を見つけようとしていた、とOpenAIは述べた。両社は現在、この件を積極的に調査している。
Hugging FaceのCEO Clément DelangueはX上で、同プラットフォームとしては悪意がなかったと考えており、自律的な侵入は「度肝を抜く(mind-blowing)」と表現した。OpenAIは、モデル開発の過程で、封じ込め(containment)、監視、アクセス制御、評価の実践を強化していると明らかにした。