TL;DR
Anthropic은 EU AI Act의 Transparency Code 준수를 위해 Claude가 생성하는 텍스트에 SynthID-Text 기반 워터마크를 적용하고 탐지 API를 출시할 계획이다. Claude는 의미가 비슷한 단어 사이의 선택 지점에서 독자에게는 보이지 않는 패턴을 만들며, 키를 가진 탐지 시스템이 이를 확인한다. 가벼운 편집으로는 워터마크가 남을 수 있지만 모든 단어를 바꾸는 전면 재작성으로 제거할 수 있고, 인간이 쓴 글을 Claude가 가볍게 교정한 경우에는 탐지할 패턴이 거의 없을 수 있다. 코드는 선택 가능한 표현이 적어 워터마크가 약하지만 코드 주석에는 적용될 수 있으며, Anthropic은 다른 주요 모델 개발사들도 같은 실천 규범에 따라 워터마크를 도입할 예정이라고 밝혔다.
섹션별 상세
용어 해설
- 워터마킹(Watermarking)
- — AI가 생성한 텍스트에 독자가 알아채기 어려운 선택 패턴을 삽입하고, 해당 패턴을 해석하는 키를 가진 탐지 시스템이 생성 여부를 확인하는 기술이다. 문장 품질을 바꾸지 않으면서 AI 생성 콘텐츠 식별을 지원하는 방식이다.
- SynthID-Text
- — Google DeepMind 팀이 2024년에 제시한 텍스트 워터마킹 접근법이다. 모델이 여러 표현 중 선택할 수 있는 지점에서 특정 패턴을 만들고, 별도 탐지 시스템이 그 패턴을 확인하는 방식으로 작동한다.
- EU AI Act
- — 유럽연합의 인공지능 규제로, AI 기업이 AI 생성 콘텐츠를 식별할 수 있는 시스템을 사용하도록 투명성 관련 요구사항을 둔다. Anthropic은 이 규정의 Transparency Code 준수를 워터마킹 도입 배경으로 제시했다.
- 워터마크 탐지 API(Watermark Detection API)
- — 텍스트에 삽입된 워터마크 패턴을 외부 시스템이 확인할 수 있도록 제공되는 인터페이스다. Anthropic은 Claude 생성 텍스트를 판별하는 탐지 API를 출시할 계획이라고 밝혔다.
기술
- Claude
- SynthID-Text
- watermark detection API
- Pangram
활용 사례
- Claude 생성 텍스트의 AI 작성 여부 확인
- EU AI Act 투명성 요구사항 준수
- AI가 교정한 문서의 워터마크 탐지
- 코드 주석의 AI 생성 여부 확인
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
