OpenAI、サイバー攻撃能力を持つAIモデルの開発ペースを一時停止

Pacing model development in an era of cyber-critical capabilities

OpenAIは、AIモデルの能力向上に伴うリスクの高まりを受け、最先端モデルの開発ペースを一時的に鈍化させた。同社は、監視・整合性・封じ込めの各セーフガードを強化するため、強化学習トレーニングを2週間停止し、最大規模のフロンティアRL実行を保留中。また、Astraモデルが重大なサイバー攻撃能力を持つ可能性が判明したことを受け、研究環境のセキュリティを強化し、チェーン・オブ・ソート監視を拡大した。OpenAIは、Preparedness Frameworkを進化させ、モデルの能力向上に合わせてセーフガードを拡張していく方針だ。

フロンティアモデルの能力は急速に加速している。我々の理解、整合性、そして安全性を確保する能力は、それに先んじていなければならない。

この日のほかの記事

2026-08-18