AI 텍스트 워터마킹의 비밀: 텍스트에 숨겨진 통계적 표식

How AI text watermarking works

AI 텍스트 워터마킹의 비밀: 텍스트에 숨겨진 통계적 표식

AI가 생성한 텍스트에 워터마크를 숨기는 원리를 시각적으로 설명한다. 텍스트에는 픽셀이나 메타데이터가 없지만, 단어 선택 사이의 미세한 통계적 편향을 통해 표식을 남길 수 있다. 비밀 키가 단어 후보를 녹색과 빨간색으로 임의로 나누고 녹색을 약간 선호하도록 주사위를 조작한다. 키를 가진 사람만이 텍스트를 다시 색칠하고 녹색 비율을 세어 워터마크를 확인할 수 있다. 편집은 표식을 지우지만, 의미를 유지한 완전한 재작성만이 효과적이다. 실제 구현에서는 탐지 정확도가 0.99에서 0.5로 떨어진다. 이 글은 Kirchenbauer, SynthID, Aaronson 등의 방식과 한계를 다룬다.

마크는 문자 자체가 아니라 문자 사이의 선택에 숨어 있다.

같은 날의 다른 소식

2026-08-14