AI 정책
Anthropic의 Claude 워터마크 계획, 제거 도구 시장을 빠르게 만들다
Business Insider가 인터뷰한 Guillaume Meyer 사례는 Claude의 보이지 않는 워터마크가 개발자 반발과 오픈소스 제거 도구, 저작권 신호 논쟁을 촉발했음을 보여준다.
Anthropic이 Claude 생성 텍스트에 표시를 넣겠다는 계획은 곧바로 반대 움직임을 만들었다. 그 표시를 제거하려는 도구들이다. 8월 23일 Business Insider 인터뷰에서 파리의 기업가 Guillaume Meyer는 Anthropic의 보이지 않는 텍스트 워터마크 발표 직후 Watermarks Remover라는 오픈소스 프로젝트를 만들었다고 말했다. 이 프로젝트는 게시 후 빠르게 퍼졌고, AI가 조금만 관여한 인간의 글까지 잘못 분류될 수 있다고 걱정하는 개발자들의 관심을 받았다.
논란은 Anthropic이 EU AI 법의 투명성 규칙을 이행하기 위해 지원되는 Claude 출력에 기계가 읽을 수 있는 표시를 넣겠다고 하면서 시작됐다. 회사는 이 표시가 눈에 보이는 라벨이 아니고, 숨겨진 문자를 추가하지 않으며, 사용자나 조직을 식별하지 않고, Claude 답변의 의미와 가독성, 품질을 바꾸지 않는다고 설명했다. 또한 사용자와 제3자가 Claude 표시를 확인할 수 있는 탐지 API를 제공할 계획이라고 밝혔다.
텍스트 워터마크의 기술적 원리는 통계적이다. 문서에 태그를 붙이는 대신 모델이 생성 중 낮은 위험의 단어 선택을 약간 유도해, 올바른 키를 가진 쪽이 전체 패턴을 나중에 감지할 수 있게 한다. 일반 독자는 알아차리기 어렵고, 텍스트를 복사해도 남을 수 있다. 그러나 사용자가 표시의 존재를 쉽게 볼 수 없고, 가벼운 편집이나 번역, 교정이 완전 생성과 어떻게 구분될지 알기 어렵기 때문에 논쟁이 커진다.
Meyer의 비판은 이 모호성에 집중된다. 그는 Business Insider에 통계적 워터마크가 오탐과 인간 피해자를 만들 수 있다고 말했다. 특히 학술이나 전문 환경에서는 긴 글의 아주 작은 부분만 AI로 고쳐도 표시가 남을 수 있다. 그는 자신의 도구가 완벽하지 않으며 탐지 시스템이 나오면 계속 바꿔야 한다고 인정했지만, 지나치게 둔한 방식에 질문을 던지고 시험하는 프로젝트라고 설명했다.
Anthropic은 반대 방향의 압력도 받는다. 규제 당국은 합성 콘텐츠의 투명성을 원하고, AI 기업은 텍스트가 제품 밖으로 나간 뒤에도 따라다닐 수 있는 신호가 필요하다. 라벨이 앱 안에만 있다면 이메일, 문서, 웹사이트, 소셜 게시물로 복사되는 순간 사라진다. 워터마크는 더 지속적인 신호를 약속하지만, 바로 그 지속성이 사용자 우려를 만든다. 사소한 편집 단계에서 생긴 표시도 평판에 영향을 줄 수 있기 때문이다.
더 큰 문제는 저작성이 더 이상 이분법이 아니라는 점이다. 한 문서는 사람이 초안을 쓰고, 모델이 다듬고, 다른 시스템이 번역하고, 편집자가 사실을 확인하고, 에이전트가 형식을 잡을 수 있다. 단일 워터마크 신호는 모델이 텍스트에 관여했다는 사실은 보여줄 수 있지만 창작 책임이 얼마나 인간에게 있었는지는 설명하지 못한다. 학교, 고용주, 출판사, 법원은 탐지 결과를 단순한 부정행위 증거로 다루지 않도록 조심해야 한다.