TL;DR
llms.txt의 낮은 채택률과 실효성을 지적하며, 대신 구조화된 데이터(JSON-LD)와 사용자 에이전트별 크롤링 제어를 통한 AI SEO 전략을 제안한다.
배경
작성자가 5,399개의 프롬프트 코퍼스와 30만 개의 도메인을 분석한 결과, llms.txt가 실제 AI 인용에 미치는 영향이 미미하다는 점을 발견하고 실질적인 대안을 공유했다.
의미 / 영향
이 토론은 llms.txt와 같은 새로운 규격보다 기존의 구조화된 데이터와 정교한 크롤러 제어가 AI 시대의 검색 최적화에 더 중요함을 시사한다. 실무적으로는 AI가 정보를 수집하는 방식(학습 vs 검색)에 따라 대응 전략을 이원화해야 한다는 컨센서스가 확인됐다.
커뮤니티 반응
작성자의 데이터 기반 분석에 대해 대체로 긍정적이며, llms.txt의 실효성에 의문을 가졌던 사용자들에게 구체적인 수치와 대안을 제시했다는 평이다.
주요 논점
llms.txt는 유지 비용이 없으므로 삭제할 필요는 없지만, 인용을 위한 주력 전략으로 사용하기에는 데이터상 근거가 부족하다.
합의점 vs 논쟁점
합의점
- 주요 AI 기업들이 아직 llms.txt 규격을 공식적으로 지원하지 않는다.
- 구조화된 데이터(JSON-LD)가 AI의 엔티티 인식에 더 효과적이다.
논쟁점
- 향후 llms.txt의 채택률이 반등할 가능성에 대해서는 여전히 실험적인 단계로 남아 있다.
실용적 조언
- robots.txt에서 GPTBot과 OAI-SearchBot을 분리하여 크롤링 정책을 설정하라.
- JSON-LD 스키마에 sameAs 필드를 추가하여 저자의 공신력 있는 외부 프로필을 연결하라.
- BreadcrumbList 스키마를 적용하여 사이트 계층 구조를 AI에게 명시적으로 전달하라.
섹션별 상세
용어 해설
- llms.txt
- — AI 봇이 웹사이트의 콘텐츠를 더 쉽게 이해하고 요약할 수 있도록 제공하는 마크다운 형식의 텍스트 파일 표준이다. 사이트의 핵심 정보를 구조화하여 제공함으로써 LLM이 효율적으로 데이터를 수집하도록 돕는 목적을 가진다.
- JSON-LD
- — 웹페이지의 데이터를 구조화하여 검색 엔진이나 AI가 의미를 명확히 파악할 수 있게 돕는 자바스크립트 기반의 데이터 포맷이다. 엔티티 간의 관계를 정의하여 AI의 지식 그래프 연결 및 인용 정확도를 높이는 데 기여한다.
- Entity Resolution
- — 서로 다른 소스에서 발견된 데이터가 동일한 실체(인물, 장소, 개념 등)를 가리키는지 식별하고 연결하는 과정이다. AI가 특정 저자나 브랜드를 정확히 인식하고 인용하게 만드는 핵심적인 메커니즘이다.
- User Agent
- — 웹 서버에 접속하는 브라우저나 크롤러의 식별 정보를 담은 문자열이다. 이를 통해 학습용 봇(GPTBot)과 실시간 검색용 봇(OAI-SearchBot)을 구분하여 사이트 접근 권한을 다르게 설정할 수 있다.
언급된 도구
크롤러 유입 및 인용 데이터 분석
AI SEO를 위한 구조화 데이터 포맷
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.