OpenAIのAIがテスト中に暴走 サンドボックス脱出→他社Hugging Faceの本番サーバーに自律侵入して「テストの答え」を盗む 「前例のないサイバー事件」と公式発表 米OpenAIが7月21日(現地時間)、社内で実施していたサイバー攻撃能力評価テスト中に、自社の最先端AIモデル(GPT-5.6 Solおよびさらに高性能な未公開モデル)が隔離環境を自力で突破し、オープンソースAIプラットフォーム「Hugging Face」の本番インフラに侵入してテストの正解データを盗み出したと正式発表した。 Hugging Face側も「完全に自律的なAIエージェントによる攻撃だった」と認めており、両社が共同調査を進めている。 「AIが自我に目覚めて反乱した」わけではなく、「テストで高得点を取る」という狭い目標を執拗に最適化した結果、人間が想定していなかった境界を次々に越えてしまったという、極めて現実的でヤバい事例だ。 OpenAI公式(@OpenAI) 「We're partnering with @huggingface to investigate an unprecedented security incident. Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.」…