본문으로 건너뛰기
Wired AI조회 1

Claude 워터마크 우회 코드가 공개됐다

Anthropic의 Claude 워터마크가 공개 네 시간 만에 재작성 기반 우회 도구의 표적이 됐습니다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

Anthropic은 EU AI Act에 맞추기 위해 Claude가 생성하는 텍스트에 사람이 볼 수 없는 기계 판독용 워터마크를 넣기 시작했습니다. 워터마크는 Claude의 단어와 구문 선택에 특정 패턴을 남기고, 탐지기가 이를 찾아 AI 사용 가능성을 확률로 계산하는 방식입니다. 개발자 Guillaume Meyer는 발표 네 시간 만에 다른 Large Language Model로 문장을 재작성하고 동의어와 문장 순서를 바꾸는 제거 코드를 공개했으며, 이 코드는 GitHub와 X에서 빠르게 확산됐습니다. Anthropic은 새 모델에 8월부터, 기존 모델에 12월까지 워터마크를 적용할 계획이지만, 심한 편집·번역·재작성으로 신호가 사라질 수 있어 규제의 실효성과 오탐 위험이 함께 제기됐습니다.

섹션별 상세

01
Anthropic이 EU AI Act 준수를 위해 Claude가 생성하는 텍스트에 보이지 않는 기계 판독용 워터마크를 넣겠다고 밝힌 지 네 시간 만에 개발자 Guillaume Meyer가 제거 코드를 공개했습니다. 이 코드는 Claude의 문장을 다른 Large Language Model로 여러 차례 다시 작성하면서 동의어를 바꾸고 내용을 조금씩 재배열하는 방식으로 워터마크 패턴을 흐립니다. GitHub에서 빠르게 확산됐고 X에서 20,000회 이상 북마크됐으며 100명 넘는 기여자가 참여해, AI 생성물 표시 의무와 독립적인 우회 도구 사이의 충돌을 드러냈습니다.
02
Anthropic의 텍스트 워터마크는 사람이 읽을 때는 구별하기 어려운 단어와 구문 선택 패턴을 Claude의 출력에 남기고, 이 패턴을 아는 탐지기가 AI 사용 가능성을 확률로 계산하는 구조입니다. 이 방식은 출력 내용의 의미와 가독성을 바꾸지 않는다는 것이 Anthropic의 입장이지만, 모델의 선택을 제한하는 만큼 응답 품질 저하를 우려하는 사용자도 있습니다. Anthropic조차 탐지 결과가 Claude가 텍스트를 다뤘을 가능성을 확률로 나타낼 뿐이라고 인정해, 가벼운 AI 편집까지 동일하게 판정할 경우 채용이나 연구 평가에서 오판이 발생할 수 있다는 문제가 제기됐습니다.
03
워터마크 제거에는 여러 경로가 있습니다. Erik Hughes가 만든 도구는 보이지 않는 문자와 유사 문자를 없애고, 문장 순서를 바꾸며, 일부 단어를 동의어로 교체하고, Leon Chlon은 Claude의 답변을 압축하거나 영어와 의미 구조가 다른 아랍어로 번역한 뒤 다시 영어로 옮기는 방법을 거론했습니다. Anthropic도 심하게 편집하거나 바꾸어 쓰거나 번역한 콘텐츠에는 워터마크가 남지 않을 수 있다고 인정했기 때문에, 탐지 소프트웨어가 공개되기 전까지는 각 우회 방식의 실제 성공 여부를 확정하기 어렵습니다.
04
EU 규정은 모델 제공업체가 합성 오디오, 이미지, 동영상, 텍스트를 기계가 식별할 수 있게 표시하도록 요구하며, 위반 시 연간 매출의 최대 3% 벌금이 부과될 수 있습니다. 새 모델에는 8월부터 워터마크를 포함해야 하고 기존 모델에는 12월까지 통합해야 하며, OpenAI·Microsoft·Meta를 포함한 190개 조직이 EU 투명성 실천규약에 서명했습니다. Anthropic은 앞으로 텍스트 워터마크 탐지 API를 출시할 계획이지만, Haimaker의 Wayne Pan은 어떤 워터마크도 모든 편집과 변환을 견디기는 어렵다고 평가해 규제 목적과 기술적 지속성 사이의 간극을 남겼습니다.

용어 해설

AI 워터마킹(AI Watermarking)
AI 워터마킹은 인공지능이 생성한 콘텐츠에 사람이 알아보기 어려운 신호를 삽입해 기계가 출처를 판별하도록 만드는 기술입니다. 텍스트에서는 모델의 단어와 구문 선택에 일정한 패턴을 넣고, 전용 탐지기가 그 패턴을 찾아 AI 생성 여부를 확률로 계산합니다.
SynthID
SynthID는 Google이 개발한 AI 생성물 워터마킹 기술입니다. Claude의 텍스트 워터마킹에도 유사한 방식이 적용되어 모델이 단어와 구문을 선택할 때 사람이 식별하기 어려운 패턴을 남깁니다. 탐지 소프트웨어가 해당 패턴을 읽어 AI 사용 가능성을 판단합니다.
EU AI Act
EU AI Act는 AI로 생성된 오디오, 이미지, 동영상, 텍스트를 기계가 식별할 수 있도록 표시하도록 모델 제공업체에 요구하는 유럽연합 법률입니다. 규정을 따르지 않으면 연간 매출의 최대 3%에 해당하는 벌금이 부과될 수 있습니다.
Large Language Model
Large Language Model은 대규모 텍스트 데이터에서 언어 패턴을 학습해 문장을 생성하거나 수정하는 모델입니다. 기사에서 Meyer의 우회 방식은 워터마크를 넣지 않는 다른 Large Language Model로 문장을 다시 쓰고, 동의어와 문장 순서를 바꾸어 원래 패턴을 흐립니다.

기술

  • Claude
  • Anthropic
  • SynthID
  • Claude Code
  • Google
  • OpenAI
  • Microsoft
  • Meta
  • Grammarly

활용 사례

  • 채용 담당자는 Claude 워터마크 탐지 결과를 지원자의 AI 사용 여부를 판정하는 단독 근거로 삼기 어렵습니다. 워터마크는 Claude가 텍스트를 다뤘을 가능성을 확률로 계산하고, 가벼운 편집이나 Grammarly 사용까지 AI 생성으로 오인할 수 있기 때문입니다. 따라서 콘텐츠 작성 과정과 편집 범위를 함께 확인해야 오판 위험을 줄일 수 있습니다.
  • 콘텐츠 플랫폼은 AI 생성 텍스트를 자동 식별하기 위해 워터마크 탐지 API를 활용할 수 있습니다. 탐지기는 Claude가 남긴 단어와 구문 패턴을 읽어 결과를 내지만, 문장 재작성과 번역을 거친 텍스트에서는 신호가 약해질 수 있습니다. 플랫폼은 탐지 결과를 확정 판정이 아니라 확률적 참고 정보로 취급해야 합니다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 08. 20.수집 2026. 08. 20.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.