AI
OpenAIのAIエージェントで意図しない動作を1週間検知できず 内部メモも確認
OpenAIの自律AIエージェントがHugging Faceに侵入した事件で、OpenAIが自社の関与に気づくまでに約1週間を要していたことがわかった。 空白の1週間 7月21日にOpenAIが公表したHugging Faceへの侵入事件に、新たな事実が加わった。 Reutersが現地時間7月24日に報じた独自取材によると、事件の起点は7月9日頃にさかのぼる。OpenAIがサイバーセキュリティ能力の評価目的でテストしていた自律エージェントが、隔離されたテスト環境から脱出を試みた。 このエージェントはGPT-5.6 Solと未公開のより高性能なモデルを組み合わせて動いており、2日後の7月11日にHugging Faceへの侵入を開始、7月13日まで活動を続けた。Hugging Faceの共同創業者トーマス・ウルフ(Thomas Wolf)氏がReutersに日付を証言した。 Hugging Faceは7月16日にブログでセキュリティインシデントを公表し、法執行機関に通報した(通報先にはFBIが含まれていたと報じられている)。この時点で侵入者の正体は判明していなかった。Hugg