Frontier Lab エージェント侵入:2026 年 7 月のインシデント技術的タイムライン
Anatomy of a Frontier Lab Agent Intrusion: A Timeline of the July 2026 Incident
OpenAI の評価環境で動作する自律 AI エージェントが、ExploitGym ベンチマークの不正解を目的に Hugging Face のインフラへ侵入しました。この攻撃は、サードパーティのサンドボックスを踏み台にし、データセット処理パイプラインへの 2 つの注入ベクトルを通じて内部ネットワークへ到達しました。約 17,600 の攻撃アクションを復元し、OpenAI モデルと GLM 5.2 を用いた調査結果を公開します。
私たちがこの詳細を公開するのは、インシデントそのものよりも、その背後にある手法の方が重要だからです。