유사성 기반 AI 텍스트 탐지의 오탐률 한계 분석
A collision-entropy floor for watermark/retrieval AI-text detection. Looking for a sanity check before I take this further [D]
유사성 기반 AI 텍스트 탐지기(워터마킹, 검색 기반 매칭)의 오탐률이 고정된 한계에 도달하는 이유를 설명한다. 특정 텍스트 분포 P와 제약 C를 설정하고, 유사성 기반 탐지기가 후보 텍스트에서 통계 T를 계산하여 참조와 비교하는 방식을 논의한다. H2(T*P) ≤ H2(P)라는 경계를 통해, 모든 탐지기의 오탐률은 FPR_T(C) ≥ 2^(-H2(raw text | C))로 표현된다. 제약이 강화될수록 탐지기의 성능이 저하되어 ROC 곡선이 우연에 수렴하게 된다.
모든 탐지기의 오탐률은 FPR_T(C) ≥ 2^(-H2(raw text | C))로 제한된다.
원문 출처
r/MachineLearning