Anthropic의 Claude 모델, AI 생성 텍스트에 워터마크 추가
AI Models Are Watermarking Text—Will You Notice?
2023년 8월 11일, Anthropic은 모든 향후 Claude 모델이 AI 생성 결과를 식별하는 워터마크를 생성한다고 발표했다. Google은 Gemini 모델의 출력에 자체 텍스트 워터마크를 사용하고 있으며, OpenAI는 텍스트 워터마크 도입을 계획하고 있다. 유럽연합의 AI 법안에 따라 2026년 8월 2일 이후 출시되는 AI 모델에는 워터마크가 의무화된다. 텍스트 워터마크는 인간이 감지하기 어려운 방식으로 단어 선택에 미세한 변화를 주어 숨겨진다. Kirchenbauer의 연구에 따르면, 텍스트 워터마크의 탐지율은 98.4%에 달하며, 단순한 패러프레이징으로는 워터마크를 숨길 수 없다.
Anthropic의 Claude 모델은 AI 생성 텍스트에 워터마크를 추가하여 유럽연합의 AI 법안에 부합하게 된다.
원문 출처
IEEE Spectrum — AI