관련 기사 바로가기
vLLM 전환으로 RTX 3090 추론 속도 향상Qwen 3.8 로컬 평가에서 드러난 추론 정지 문제OpenCode가 LM Studio API로 로컬 LLM 추론을 지원함로컬 LLM 워크스테이션 구축 및 Hermes AI 에이전트 실전 가이드CAIA: 로컬 LLM을 위한 Context-Adaptive Intelligence Agent와 동적 라우팅 아키텍처Gemma 4 31B 모델의 효율성과 배포 전략로컬 LLM 백엔드를 활용한 윈도우용 화면 캡처 및 클립보드 AI 어시스턴트 공개Qwen 3.8의 ACT PDF 풀이 성능LM Studio와 llama.cpp의 GPU 레이어 상한 차이LLM 바깥에 정서와 시간을 구현한 로컬 캐릭터실제 테스트 스위트로 파인튜닝 효과를 검증하는 도구 공개 및 사전등록 실험 결과 공유Ornith 모델을 로컬에서 실행하는 방법로컬 LLM 실행을 위한 고성능 래퍼, LlamaStash 소개Octopus Agents V2.2: 단일 워크스테이션에서 구동되는 34개 에이전트 로컬 AI 메시실전 AI 에이전트 설정을 공유하는 오픈소스 저장소 ai-setup노트북에서 실행한 Qwen 3.6 35B 모델이 Claude Opus 4.7보다 더 나은 펠리컨 그림을 생성했다Claude로 개발한 로컬 AI 기반 Apple Notes 검색 및 채팅 도구 'NotesAI'Gemma 4 26B 기반 로컬 이기종 GPU 분산 챗봇 UI 개발 및 공개LM Studio에서 외부 GGUF 모델의 'Thinking' 기능을 수동으로 활성화하는 방법Gemma 4 26B를 활용한 비주얼 노벨 실시간 번역 성능 및 VRAM 효율성 테스트