본문으로 건너뛰기

브리태니커 백과사전, 콘텐츠 '암기' 및 저작권 침해 혐의로 OpenAI 고소

브리태니커 백과사전과 메리엄-웹스터가 OpenAI를 상대로 자사 콘텐츠를 무단 학습하고 거의 동일한 내용을 출력하여 트래픽을 가로챘다며 소송을 제기했다.

섹션별 상세

01
브리태니커 백과사전과 메리엄-웹스터는 OpenAI가 저작권이 있는 콘텐츠를 무단으로 사용하여 AI 모델을 학습시켰다며 소송을 제기했다.
02
원고 측은 GPT-4가 브리태니커의 내용을 대량으로 암기하고 있으며 특정 요청에 대해 원문과 토씨 하나 틀리지 않은 '근접 복사본'을 출력한다고 주장하며 증거를 제시했다.
03
소송장에는 OpenAI 모델의 응답과 브리태니커의 텍스트를 나란히 비교한 사례가 포함되었으며 일부 구절은 단어 하나까지 완벽하게 일치하는 것으로 나타났다.
04
브리태니커는 OpenAI가 사용자에게 원본 웹사이트 링크를 제공하는 대신 정보를 직접 생성하여 제공함으로써 웹 트래픽을 '잠식(cannibalizing)'하고 있다고 비판했다.
05
이번 사건은 뉴욕타임스의 OpenAI 소송 및 앤스로픽(Anthropic)의 15억 달러 규모 저작권 합의 사례와 맥을 같이하며 AI 업계의 저작권 분쟁이 심화되고 있음을 보여준다.

용어 해설

암기 현상(Memorization)
AI 모델이 학습 데이터에 포함된 특정 문장이나 정보를 통계적 추론을 넘어 원문 그대로 기억하고 출력하는 현상이다. 이는 저작권이 있는 텍스트를 무단으로 복제하여 배포하는 것과 유사한 결과를 초래하여 법적 분쟁의 핵심 쟁점이 된다.
트래픽 잠식(Cannibalization)
AI 서비스가 원본 콘텐츠의 내용을 직접 요약하거나 제공함으로써 사용자가 원본 웹사이트를 방문할 필요를 없게 만드는 현상이다. 기존 검색 엔진과 달리 원본 출처로의 유입을 차단하여 콘텐츠 생산자의 광고 수익이나 비즈니스 모델을 위협한다.
저작권 침해(Copyright Infringement)
저작권자의 허락 없이 저작물을 복제, 공연, 방송, 전시 등의 방법으로 이용하는 행위이다. AI 분야에서는 대규모 언어 모델 학습에 사용되는 데이터의 수집 과정과 모델이 생성하는 결과물의 유사성이 주요 침해 여부 판단 기준이 된다.

기술

  • GPT-4
  • OpenAI API

활용 사례

  • AI 학습 데이터 라이선싱
  • 저작권 침해 방지 필터링
  • AI 생성물 유사도 검증
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 03. 17.수집 2026. 03. 17.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.