본문으로 건너뛰기
Common Crawl
커먼 크롤
웹상의 방대한 데이터를 수집하여 공개하는 비영리 프로젝트로, 대규모 언어 모델 학습을 위한 기초 데이터셋으로 널리 쓰인다.
비슷한 개념
LLM Crawler
fineweb
Corpus
Data Scraping
LLM Knowledge Base
Training Corpus
Open Corpus
Public Datasets
← 용어 사전 전체 보기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필