본문으로 건너뛰기
Reddit
소스별 피드
아티클 2,181개
r/LocalLLaMA
로컬 LLM 실행, 파인튜닝, 최적화 기술 논의 (30만+ 구독자)
최신 글
조회수순 — 오늘
조회수순 — 이번 주
조회수순 — 이번 달
관심 태그 추가
Inference
Products
Language Models
Audio AI
Libraries
Hardware
Architecture
Training
Dev Tools
Best Practices
Optimization
Agents
Safety
TIME
HEADLINE
18일 전
RDT
RDT
싼 A100이 토큰당 3.3배 비쌌다
1
요약 펼치기
18일 전
RDT
RDT
Qwen3.8-27B 4-bit 품질 격차
2
요약 펼치기
18일 전
RDT
RDT
AMD에서 Chatterbox TTS를 막은 두 CUDA 의존성
요약 펼치기
18일 전
RDT
RDT
Strix Halo에서 14B 입력 처리 2배
요약 펼치기
18일 전
RDT
RDT
16GB GPU에서 양자화 차이를 재다
요약 펼치기
18일 전
RDT
RDT
DGX Spark 36대로 홈랩 클러스터 확장
5
요약 펼치기
18일 전
RDT
RDT
Qwen3.8의 강점과 Git 권한 위험
요약 펼치기
18일 전
RDT
RDT
Gemma 12B, 도구 호출 15.7% 증가
요약 펼치기
18일 전
RDT
RDT
Kimi K2 Thinking, τ²-Bench 93%
요약 펼치기
18일 전
RDT
RDT
llama-leash, 측정으로 검증하는 로컬 코딩 하네스
요약 펼치기
18일 전
RDT
RDT
로컬 LLM 추론 병목의 위치
1
요약 펼치기
18일 전
RDT
RDT
Qwen3.6, 65k 토큰부터 기다림의 벽
요약 펼치기
19일 전
RDT
RDT
CMP170HX, Qwen3.6-35B 추론 2배
요약 펼치기
19일 전
RDT
RDT
Q8은 VRAM을 아껴도 생성 속도에서 진다
요약 펼치기
19일 전
RDT
RDT
6개 파일에 심은 60개 공격
요약 펼치기
19일 전
RDT
RDT
GPU UV, 학습으로 검증
1
요약 펼치기
19일 전
RDT
RDT
RTX 5090 한 장의 262K Qwen
요약 펼치기
19일 전
RDT
RDT
Ornith1.5, 무전 작업을 14초로 단축
요약 펼치기
19일 전
RDT
RDT
Qwen 3.5 4B 추론 점수 16.67% 회복
요약 펼치기
19일 전
RDT
RDT
B70 추론을 Helm 차트로 묶다
요약 펼치기
19일 전
RDT
RDT
긴 코딩엔 MTP보다 지속 속도
요약 펼치기
19일 전
RDT
RDT
256k 프리필을 4k 청크로 나누자
요약 펼치기
19일 전
RDT
RDT
V620의 ROCm·Vulkan 속도 비교
요약 펼치기
19일 전
RDT
RDT
Qwen 3.6 35B가 레시피북 코딩전에서 우승
요약 펼치기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필