TL;DR
Anthropic은 EU AI Act에 맞추기 위해 Claude가 생성하는 텍스트에 사람이 볼 수 없는 기계 판독용 워터마크를 넣기 시작했습니다. 워터마크는 Claude의 단어와 구문 선택에 특정 패턴을 남기고, 탐지기가 이를 찾아 AI 사용 가능성을 확률로 계산하는 방식입니다. 개발자 Guillaume Meyer는 발표 네 시간 만에 다른 Large Language Model로 문장을 재작성하고 동의어와 문장 순서를 바꾸는 제거 코드를 공개했으며, 이 코드는 GitHub와 X에서 빠르게 확산됐습니다. Anthropic은 새 모델에 8월부터, 기존 모델에 12월까지 워터마크를 적용할 계획이지만, 심한 편집·번역·재작성으로 신호가 사라질 수 있어 규제의 실효성과 오탐 위험이 함께 제기됐습니다.
섹션별 상세
용어 해설
- AI 워터마킹(AI Watermarking)
- — AI 워터마킹은 인공지능이 생성한 콘텐츠에 사람이 알아보기 어려운 신호를 삽입해 기계가 출처를 판별하도록 만드는 기술입니다. 텍스트에서는 모델의 단어와 구문 선택에 일정한 패턴을 넣고, 전용 탐지기가 그 패턴을 찾아 AI 생성 여부를 확률로 계산합니다.
- SynthID
- — SynthID는 Google이 개발한 AI 생성물 워터마킹 기술입니다. Claude의 텍스트 워터마킹에도 유사한 방식이 적용되어 모델이 단어와 구문을 선택할 때 사람이 식별하기 어려운 패턴을 남깁니다. 탐지 소프트웨어가 해당 패턴을 읽어 AI 사용 가능성을 판단합니다.
- EU AI Act
- — EU AI Act는 AI로 생성된 오디오, 이미지, 동영상, 텍스트를 기계가 식별할 수 있도록 표시하도록 모델 제공업체에 요구하는 유럽연합 법률입니다. 규정을 따르지 않으면 연간 매출의 최대 3%에 해당하는 벌금이 부과될 수 있습니다.
- Large Language Model
- — Large Language Model은 대규모 텍스트 데이터에서 언어 패턴을 학습해 문장을 생성하거나 수정하는 모델입니다. 기사에서 Meyer의 우회 방식은 워터마크를 넣지 않는 다른 Large Language Model로 문장을 다시 쓰고, 동의어와 문장 순서를 바꾸어 원래 패턴을 흐립니다.
기술
- Claude
- Anthropic
- SynthID
- Claude Code
- OpenAI
- Microsoft
- Meta
- Grammarly
활용 사례
- 채용 담당자는 Claude 워터마크 탐지 결과를 지원자의 AI 사용 여부를 판정하는 단독 근거로 삼기 어렵습니다. 워터마크는 Claude가 텍스트를 다뤘을 가능성을 확률로 계산하고, 가벼운 편집이나 Grammarly 사용까지 AI 생성으로 오인할 수 있기 때문입니다. 따라서 콘텐츠 작성 과정과 편집 범위를 함께 확인해야 오판 위험을 줄일 수 있습니다.
- 콘텐츠 플랫폼은 AI 생성 텍스트를 자동 식별하기 위해 워터마크 탐지 API를 활용할 수 있습니다. 탐지기는 Claude가 남긴 단어와 구문 패턴을 읽어 결과를 내지만, 문장 재작성과 번역을 거친 텍스트에서는 신호가 약해질 수 있습니다. 플랫폼은 탐지 결과를 확정 판정이 아니라 확률적 참고 정보로 취급해야 합니다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
