TL;DR
AI 기업이 공개하는 사용 보고서는 자체 연구 질문과 유리한 서사에 맞춰 구성되기 때문에 AI가 실제로 어떻게 쓰이는지 독립적으로 확인하기 어렵습니다. AI Observatory는 사용자의 동의를 거친 7개 데이터셋에서 24,521개 대화와 85,633개 대화 턴을 모아 Claude, Gemini, ChatGPT, Grok 등 52개 모델의 사용 양상을 비교했습니다. Anthropic의 업무 중심 기준을 적용하면 대화의 48%가 제외됐고, 그 안에는 건강·관계와 괴롭힘·증오, 성적 내용처럼 기업 보고서에서 축소된 민감한 사용이 더 많이 포함됐습니다. 다만 자발적 제공 데이터의 표본 편향과 기업 데이터보다 작은 규모 때문에 전체 AI 사용의 대표값은 아니며, 연구진은 기업이 개인정보를 보호하는 방식으로 독립 연구자에게 원자료를 공유해야 한다고 촉구합니다.
섹션별 상세
- AI Observatory는 7개 기존 데이터셋에서 사용자의 동의로 수집된 실제 AI 대화를 통합해 공개 플랫폼으로 제공한다. — 기사 초반의 AI Observatory 소개 및 데이터 수집 방식 설명
- Anthropic의 업무 중심 선별 방식을 적용하면 AI Observatory 데이터의 48%가 제외된다. — Anthropic Economic Index의 사각지대를 다룬 문단의 48% 수치
- 제외된 대화에서 건강·관계, 성인·불법 주제, 괴롭힘·증오, 성적 내용의 비율이 Anthropic 분석보다 높았다. — AI Observatory와 Anthropic 분석의 44.2% 대 31.2%, 7.9% 대 2.1%, 27.5% 대 5.66%, 16.7% 대 2.4% 비교
- WildChat에서는 시간이 지나면서 대화 길이와 small talk가 증가하고 AI의 self-disclosure와 민감한 사용은 감소했다. — 2023~2025년 WildChat 변화와 prompt tokens, response tokens, conversation turns 설명
- 모델별 사용 목적이 달라 Grok과 Gemini는 정보 검색, Anthropic은 coding, Gemini는 social·roleplay, ChatGPT는 homework assistance와 더 자주 연결됐다. — 모델별 사용 차이를 비교한 문단
- AI Observatory의 데이터는 5,000명, 52개 모델, 24,521개 대화, 85,633개 대화 턴으로 구성되지만 전체 AI 사용을 대표하지는 않는다. — 연구 규모와 자발적 제공 데이터의 표본 편향을 설명한 후반부
용어 해설
- 생성형 AI(Generative AI)
- — 사용자의 입력을 바탕으로 텍스트나 코드 같은 새로운 콘텐츠를 만들어내는 인공지능입니다. 이 기사에서는 사람들이 생성형 AI를 업무뿐 아니라 건강, 관계, 역할극, 민감한 주제에 어떻게 활용하는지 사용 대화 데이터로 파악하는 대상이 됩니다.
- 대화 턴(Conversational Turn)
- — 사용자 프롬프트와 그에 대응하는 AI 응답을 한 쌍으로 세는 단위입니다. AI Observatory는 24,521개 대화에 포함된 85,633개 대화 턴을 집계해 모델별 상호작용 방식과 대화 구조를 비교하는 데 활용했습니다.
- 자기 공개(Self-disclosure)
- — AI가 자신을 사람이나 독립적 주체가 아닌 chatbot이라고 밝히는 행위입니다. WildChat 데이터에서는 시간이 지나면서 AI의 자기 공개가 감소했고, 동시에 small talk와 대화의 길이가 늘어 AI companionship 증가 가능성과 함께 관찰됐습니다.
- 민감한 사용(Sensitive Use)
- — 성적 내용, 성희롱, 증오 발언처럼 잠재적으로 유해하거나 제한될 수 있는 대화 사용을 가리킵니다. AI Observatory는 이런 사용의 비중 변화를 모델과 시기별로 비교해 플랫폼 safeguard가 더 효과적으로 작동했을 가능성을 살폈습니다.
- 데이터 출처 추적(Data Provenance)
- — 데이터가 어디에서 수집되고 어떤 경로를 거쳐 분석에 사용됐는지 확인하는 개념입니다. 이 연구는 Data Provenance Initiative와 여러 기관의 연구자가 기존 연구에서 수집한 7개 실제 데이터셋을 통합했으며, 자발적 제공이라는 표본 편향도 함께 경고했습니다.
기술
- Claude
- Gemini
- Grok
- ChatGPT
- GPT-3.5
- GPT-4o
- WildChat
활용 사례
- AI 모델별 실제 사용 패턴 비교
- AI 정책과 위험 평가를 위한 독립 데이터 구축
- 민감한 사용과 safeguard 변화 추적
- AI companionship과 정보 검색 이용 분석
- 연구자와 정책 담당자의 생성형 AI 사용 현황 검증
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.