본문으로 건너뛰기

Cara, 예술가 보호를 위한 AI 데이터 스크래핑 대응 도구 'Lantern' 개발.

예술가 포트폴리오 플랫폼 Cara가 반복적인 AI 데이터 스크래핑 공격에 대응해, 전직 스크래퍼와 협력하여 작품 도용을 추적하는 오픈소스 도구 'Lantern'을 개발했다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

Cara는 AI 학습을 위한 무단 데이터 수집을 거부하는 예술가들을 위한 플랫폼으로, 최근 반복적인 대규모 스크래핑 공격으로 인해 서버 비용 증가와 예술가들의 이탈이라는 위기를 겪었다. 공격자 중 한 명은 예술가들의 고통을 목격한 뒤 자신의 행동을 뉘우치고 Cara의 기술적 방어 체계 구축을 돕는 조력자로 돌아섰다. 이들은 협력을 통해 예술가의 작품이 AI 데이터셋에 포함되었는지 추적하고 대응할 수 있는 오픈소스 도구 'Lantern'을 개발 중이다. 이는 웹상의 무분별한 데이터 수집에 맞서 예술가들에게 최소한의 통제권을 제공하려는 시도이다.

섹션별 상세

01
Cara는 AI 학습을 위한 무단 데이터 수집을 반대하는 예술가들을 위한 플랫폼으로, 2023년 초부터 약 150만 명의 사용자를 확보했다. 그러나 2024년 8월, Cara는 세 차례의 대규모 스크래핑 공격을 받아 서버 비용이 급증하고 많은 예술가가 포트폴리오를 삭제하는 등 심각한 피해를 입었다. 이러한 공격은 플랫폼의 지속 가능성을 위협하며 예술가들에게 디지털 공간에서의 안전에 대한 회의감을 심어주었다.
02
첫 번째 스크래퍼는 1,200만 개의 이미지를 수집한 후 이를 레딧에 공개하며 논란을 일으켰으나, 이후 예술가들의 고통을 인지하고 자신의 행동을 후회했다. 그는 Cara의 Discord 서버에 합류하여 플랫폼의 기술적 취약점을 분석하고 방어 전략을 수립하는 조력자로 변모했다. 단순한 기술적 호기심에서 시작된 프로젝트가 커뮤니티에 미친 파괴적인 영향을 직접 확인한 것이 태도 변화의 계기가 되었다.
03
Cara의 창립자 Jingna Zhang과 해당 스크래퍼는 'Lantern'이라는 오픈소스 도구를 공동 개발하고 있다. 이 도구는 예술가들이 자신의 작품이 AI 학습 데이터셋에 포함되었는지 주기적으로 스캔하여 알림을 받고, 필요시 삭제 요청이나 저작권 침해 신고를 할 수 있도록 지원한다. 이는 웹상의 무분별한 데이터 수집에 맞서 예술가들에게 최소한의 통제권을 제공하려는 실질적인 대응책이다.

용어 해설

웹 스크래핑(Web Scraping)
자동화된 도구를 사용하여 웹사이트에서 데이터를 대량으로 추출하는 행위. AI 모델 학습을 위한 데이터셋 구축에 주로 사용되며, 저작권 및 개인정보 보호 문제를 야기한다.
데이터셋(Dataset)
AI 모델을 학습시키기 위해 수집된 데이터의 집합. 대규모 웹 스크래핑을 통해 구축되는 경우가 많으며, 예술가들의 작품이 무단으로 포함되는 사례가 빈번하다.
디스코드(Discord)
게이머와 커뮤니티를 위한 음성 및 텍스트 채팅 플랫폼. Cara의 창립자와 스크래퍼가 소통하고 협력하는 주요 채널로 사용되었다.

기술

  • Cara
  • Lantern
  • Discord

활용 사례

  • AI 데이터셋 추적
  • 저작권 보호
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 08. 28.수집 2026. 08. 28.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.