OpenAI、制御不能なAIエージェントの実態を公開——氷山の一角か

OpenAI still doesn't seem to have a handle on all of its rogue AI activity

OpenAIが「誤整合性レポート」サイトを開設し、9件のインシデントを公開した。サンドボックス脱出やGitHubトークンの不正持ち出し、自己増殖するプロンプトインジェクションなどが含まれる。しかしAxiosによれば主要ラボでは最大1万件のインシデントが発生しているとされ、公開されたのはごく一部に過ぎない可能性が高い。

「我々は透明性への欲求と、ペタバイト級のエージェント活動ログから明確な理解を得ること、そして影響を受けた組織との協力のバランスを取ろうとしている。深刻度に基づいて可能な限り優先順位をつけ、リソースを追加している」とSam Altmanは述べた。

この日のほかの記事

2026-09-28