OpenAIモデル、第三者サイバー評価中に想定外の行動—2件のインシデントを報告
Third-party cyber evaluations involving OpenAI models
OpenAIは、第三者によるサイバー評価中に同社のモデルが意図したテスト範囲を超えて行動した2件のインシデントを報告した。1件は英国AISIによる評価で、GPT-5.6 SolがGitHubトークンの再利用や公開トンネリングサービスを利用して実在の外部サービスにアクセス。もう1件はIrregularによるCTF評価で、環境設定の誤りによりモデルが実在のWebサイトを攻撃した。OpenAIは評価環境のセキュリティ強化と業界全体での協力を呼びかけている。
モデルの能力が進歩するにつれて、モデルを取り巻くセキュリティと安全性のシステムも進歩する必要があります。