40,000회 게임 플레이 결과: 인간은 AI 에이전트 위협의 3분의 1을 놓쳤다
Humans missed 1 in 3 threats approving AI agent commands across 40k game runs

AI 코딩 에이전트의 명령을 승인하거나 거부하는 브라우저 게임의 40,000회 이상 플레이 데이터를 분석한 결과, 플레이어는 위협 명령의 약 3분의 1(평균 정확도 66.3%)을 놓쳤습니다. 특히 `npm run analyze`와 같은 친숙한 명령에 숨은 페이로드는 64.7%의 높은 누락률을 보였으며, 시간 압박이 커질수록 누락률이 증가했습니다. 반면 안전한 명령도 과도하게 차단되어 인간 감독의 피로와 비효율성이 드러났습니다.
“사용자가 승인을 많이 볼수록 각 승인에 주의를 기울이지 않게 되며, 시간이 지남에 따라 감독에 훨씬 덜 주의를 기울이게 됩니다.”