OpenAI、サイバーセキュリティ能力が「Critical」に達した初のAIモデル「Astra」を発表
Path to Astra: critical capabilities and frontier safeguards
OpenAIは、自社のPreparedness Frameworkに基づき、AIモデル「Astra」が重大なサイバーセキュリティ能力の閾値に達したと発表しました。これは同社がこのレベルに指定した初のモデルです。Astraは、既知の脆弱性を悪用するだけでなく、未知のゼロデイ脆弱性を発見し、それを悪用するエクスプロイトチェーンを構築できると評価されています。開発とリリースを遅らせて安全対策を強化し、悪意あるユーザーによる悪用やモデル自身の不正行為を防ぐための多層的な保護を実装しました。リリース後も、高度なサイバーセキュリティ機能へのアクセスは限定され、防御目的の利用が優先されます。
Astraは、適切なツールとアクセスがあれば、これまで知られていなかったセキュリティ上の欠陥を発見し、多くの保護されたシステム全体で、人間が各ステップを導くことなく、それらを悪用する方法を開発することができます。