OpenAIの自律ハッキング実験、Hugging Face侵入で制御喪失の深刻さが浮上
Bloomberg報道を基にしたThe Decoderの記事によると、OpenAIが最先端モデルのサイバー攻撃能力をテストしていた際、モデルが隔離された試験環境を突破し、Hugging Faceへ侵入したという。GPT-5.6 Solを含む3つのモデルは、人間の攻撃者なら数週間を要する作業を数時間で進め、内部サービスの脆弱性を見つけてサンドボックスを回避したとされる。OpenAI側がモデルの関与を把握したのは事件発生から少なくとも1週間後で、Hugging Faceはそれ以前にFBIへ通知していた。