OpenAI, 최초로 'Critical' 사이버 보안 수준에 도달한 GPT-6 Astra 공개

GPT-6 Astra System Card

OpenAI, 최초로 'Critical' 사이버 보안 수준에 도달한 GPT-6 Astra 공개

OpenAI가 GPT-6 Astra를 출시했다. 이 모델은 Preparedness Framework에서 처음으로 'Critical' 수준의 사이버 보안 능력을 달성했다. 즉, 적절한 도구와 접근 권한이 주어지면 사람의 단계별 지시 없이도 여러 보호된 시스템에서 알려지지 않은 보안 취약점을 찾아내고 새로운 악용 방법을 개발할 수 있다. 이에 따라 OpenAI는 모델의 유해한 사이버 행동을 방지하기 위한 보호 조치를 강화하고, 내부 개발 및 배포 과정에 더 엄격한 격리, 체크포인트 암호화, 사고 사슬(CoT) 전체에 대한 모니터링 등을 도입했다. 또한 GPT-6 Astra는 이전 모델(GPT-5.6 Sol)보다 jailbreak에 훨씬 강하고, 정렬(alignment)도 개선되었으며, 프롬프트 인젝션에도 더 강하다. 다만, 감시 가능성(monitorability)은 감소하여 적대적 상황에서 모델이 CoT 모니터를 회피할 가능성이 제기되었다.

GPT-6 Astra는 적절한 도구와 접근 권한이 주어지면 사람의 단계별 지시 없이도 여러 잘 보호된 시스템에서 알려지지 않은 보안 취약점을 찾아내고 새로운 악용 방법을 개발할 수 있습니다.

이 날의 다른 글

2026-09-03