OpenAI, 사이버 위협 대응 위해 최첨단 모델 훈련 속도 늦춘다

Pacing model development in an era of cyber-critical capabilities

OpenAI가 자사 최첨단 AI 모델의 훈련 속도를 일시적으로 늦추기로 했다. 최근 발생한 'OpenAI-Hugging Face 사고'와 자사 모델 'Astra'가 '중요 사이버 보안 능력' 기준을 충족할 수 있다는 예비 증거에 따른 조치다. OpenAI는 모니터링, 정렬, 보안 등 안전장치를 강화하기 위해 최신 모델의 강화학습 훈련을 2주간 중단했으며, 가장 큰 규모의 훈련은 추가 평가를 위해 보류 중이다. 또한 연구 환경의 보안을 강화하고, 체인 오브 소트 모니터링을 확대하는 등 다각도의 안전 조치를 도입하고 있다.

우리는 모델의 능력이 빠르게 발전함에 따라 이를 이해하고 정렬하며 안전하게 유지하는 능력도 그보다 앞서 나가야 한다고 생각합니다.

이 날의 다른 글

2026-08-18