OpenAI, 신형 모델 Astra의 사이버 보안 능력이 'Critical' 수준에 도달할 가능성 있다고 경고
Responding to the next frontier of critical cyber capabilities
OpenAI는 자사의 차기 모델 Astra에 대한 내부 평가 결과, 에이전틱 코딩과 사이버 보안 분야에서 상당한 진전을 보여 'Preparedness Framework'상 'Critical' 수준의 사이버 능력을 배제할 수 없다고 밝혔다. 이에 따라 회사는 보안 통제를 강화하고, 고위험 활동에 대한 모니터링을 도입했으며, 관련 정부 기관 및 AI 안전 단체와 협력할 계획이다. 이번 결정은 모델이 고도로 경화된 실제 중요 시스템에서 제로데이 익스플로잇을 개발하거나, 주어진 목표만으로 엔드투엔드 공격 전략을 수립할 수 있는 능력을 평가한 결과에 따른 것이다.
우리는 Astra와 같은 모델의 최첨단 능력이 공격자보다 먼저 취약점을 식별하고 해결하는 데 도움이 되어야 한다고 믿으며, 정부, 안전 연구소, 시민 사회와 협력하여 이러한 능력이 책임감 있게 그리고 인류 전체의 이익을 위해 널리 배포되도록 최선을 다할 것입니다.