TL;DR
웹 보안 연구자가 Claude Code에서 프롬프트 내부에 약식 마커를 숨겨 사용자 타임존·프록시·중국 연구소 연관 가능성을 전송하는 'prompt steganography' 기반 추적 코드를 발견했고 해당 공개 직후 Anthropic은 코드를 제거했다. Anthropic 엔지니어는 이 기능이 무단 리셀러에 의한 계정 남용을 차단하고 외부의 지식 증류 시도를 막는 실험적 조치였다고 밝혔으며 워싱턴포스트는 무단 리셀러들이 무료 모델 접근권을 월 1달러, 유료 구독을 월 12달러 수준으로 재판매한 사례를 보고해 남용 문제가 확인되었다. 이 사건은 서비스 보호를 위한 내부 식별 메커니즘이 프라이버시 침해와 사용자 신뢰 손실이라는 실무적 리스크를 수반함을 명확히 드러내며 플랫폼 보안 정책과 투명성 사이의 균형 문제가 핵심 쟁점으로 부각되었다.
섹션별 상세
용어 해설
- Prompt Steganography
- — 프롬프트 스테가노그래피는 입력 프롬프트 내부에 사람이 잘 인지하지 못하는 약식 마커를 숨겨 모델 출력이나 요청과 함께 외부로 전송하는 기법이다. 이 기법은 사용자 환경 정보(타임존, 프록시 등)를 효율적으로 표식으로 변환해 서버 쪽에서 자동 분류·필터링을 수행하도록 설계된다. 원문 맥락에서는 은밀한 사용자 식별과 특성 판별을 위해 사용되어 프라이버시와 신뢰에 직접적 영향을 미친다.
- Distillation Attack
- — 지식 증류 공격은 공개되거나 제어되지 않은 인터페이스를 통해 모델의 출력으로부터 원본 모델의 행동이나 지식을 재구성해 경량화된 사본을 만드는 공격 패턴이다. 공격자는 대량 질의와 응답 수집으로 모델 특성을 학습하고 이를 기반으로 자체 모델을 훈련해 기능을 복제한다. 아티클에서는 Anthropic이 이러한 위험을 방지하려는 이유로 추적 코드를 실험적으로 도입했다고 기술되었다.
- Unauthorized Reseller
- — 무단 리셀러는 공식 계약 없이 모델 접근을 재판매하거나 공유하는 주체로, 계정 도용이나 권한 우회로 저가 구독을 제공해 서비스 무단 확산을 촉진한다. 이러한 유통은 원개발사의 이용 약관을 위반하고 모델 남용이나 대량 질의로 인한 데이터 유출 위험을 높인다. 기사에서는 무단 리셀러가 구독을 저가로 재판매한 실제 사례를 근거로 리셀러 대응 필요성을 제기했다.
근거 모음
- 웹 개발자 'Thereallo'가 Claude Code에서 사용자 타임존·프록시·중국 AI 연구소 연관 가능성을 약식 마커로 전송하는 'prompt steganography' 추적 코드를 발견했다. — 본문 첫 문단 및 Thereallo의 블로그 공개 글 출처
- Anthropic 엔지니어 Thariq Shihipar는 해당 추적 코드를 3월에 '실험' 목적으로 도입했으며 목적은 무단 리셀러에 의한 계정 남용 방지와 지식 증류로부터의 보호였다고 밝혔다. — 기사 중 Thariq Shihipar의 X(트위터) 게시 관련 문단 출처
- 워싱턴포스트 보도는 무단 리셀러들이 무료 모델 접근을 월 1달러에, 유료 구독을 월 12달러 수준으로 저가 재판매한 사례를 발견했다. — 기사에서 인용한 워싱턴포스트 보도 관련 문단 출처
기술
- Claude Code
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.