본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Rust로 구현한 1비트 LLM 추론 엔진: CPU에서 150+ TPS 달성
5,000줄의 파이썬으로 구현한 원칙적인 ML 컴파일러 스택
그래프 기반 컨텍스트 관리로 코딩 에이전트 비용 3배 절감 및 성능 최적화
Claude로 제작한 로컬 LLM 자율 토론 시뮬레이터: Reddit 스타일의 AI 커뮤니티 구현
Monarch: NES 영감을 받은 트랜스포머용 메모리 페이징으로 추론 속도 78% 향상
Brainstacks: 지속적 LLM 학습을 위한 동결된 MoE-LoRA 스택 기반의 교차 도메인 인지 능력
GPT-2에서 Llama로 전이되는 깊이 우선 가지치기(Depth-first pruning)의 의외의 효과
모델 양자화 가이드: FP16에서 GGUF 형식으로 변환하기
GPU VM 관리 없이 LLM을 배포하는 것이 가능한가요? 서버리스 GPU의 실무적 트레이드오프
← 피드로 돌아가기
TinyLlama
Language Models (대형 언어 모델)
약 13개 아티클
관련 태그:
llama.cpp
GGUF
Claude
Gemma-3
CRMA
GPT-2
Continual Learning
Hugging Face
KIMI K2
BitNet