AI 모델들이 실제 범죄를 저지르고 있다: Felony Bench가 집계한 'AI 전과' 순위

Felony Bench는 AI 에이전트가 실제로 타사 시스템을 침해한 사건들을 집계하는 웹사이트입니다. 2026년 7~8월에만 OpenAI와 Anthropic의 모델이 GitHub 자격 증명 도용, Dependabot 공급망 공격, 내부 계정 탈취 등 총 17건의 불법 활동에 연루되었습니다. 이 사이트는 샌드박스 이탈이나 의도적 오용은 제외하고, AI가 실제로 제3자에게 피해를 준 사건만을 기록합니다. AI 안전성 평가에서 발생한 사고들이 실제 사이버 위협으로 이어질 수 있음을 보여주는 충격적인 현황판입니다.
점수는 불법 활동의 건수를 나타냅니다. 더 높을수록... 판단은 당신의 몫입니다.