본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
AKMessi/pactrail: Rust로 구현된 검증 중심 코딩 에이전트 하니스와 변경 영수증·트레이스
theprint/auto-sft — LoRA 파인튜닝 자동화 파이프라인
Qwen Coder 80B 모델의 Apex 양자화 및 I-Matrix 버전 공개
Qwen3-8B로 비교하는 GGUF, AWQ, EXL2 양자화 포맷의 특징
소비자용 하드웨어 구동을 위한 9B Qwen 구조화 데이터 추출 모델 양자화 벤치마크
.NET 네이티브 LLM 인퍼런스 엔진용 GGUF 모델 지원
Qwen3.5-4B용 10MB LoRA 어댑터와 내부 신호 기반 competence-gate 오픈 리서치
메타인지 오케스트레이션: 자율 검증 및 동적 가중치 업데이트를 위한 모듈형 프레임워크
HunyuanOCR: 보급형 하드웨어에서 압도적 성능을 기록한 로컬 OCR 모델
Intel 258V iGPU 기반 소형 LLM 양자화 벤치마크 결과 분석
Nucleus-X: 로컬 GGUF 모델을 위한 보안 중심 추론 커널 및 함수 호출 가드레일
Qwen3.5 35B A3B 모델 수정 및 Claude Opus 데이터셋 기반 파인튜닝 버전 공개
Zyphra의 Zamba2 v2 모델 GGUF 변환 및 RTX 4090 벤치마크 결과
Qwen3.5-9B 기반 에이전트 특화 모델 Harmonic-9B 및 필터링된 데이터셋 공개
LM Studio에서 외부 GGUF 모델의 'Thinking' 기능을 수동으로 활성화하는 방법
Gemma-4-26B-A4B 모델의 GGUF 양자화 직접 수행 경험 및 가이드 공유
quant.h: 단일 헤더 파일로 구현된 순수 C 언어 LLM 추론 엔진
llama-server와 router-config.ini를 활용한 로컬 LLM 동적 전환 및 관리 방법
Gemma 4 E4B 및 E2B 무검열 멀티모달 모델 출시
Gemma-4-31B-it Abliterated GGUF 모델 공개
← 피드로 돌아가기
GGUF
Libraries (AI 라이브러리)
약 77개 아티클
관련 태그:
llama.cpp
Qwen3.5
Unsloth
Quantization
Qwen
Ollama
Hugging Face
Stable Diffusion
LM Studio
ComfyUI