본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Attemory 프로젝트는 어텐션 기반 검색을 통해 대화형 메모리와 코드베이스에서 고리콜 검색 품질을 개선하는 오픈소스 검색 엔진이다 이 시스템은 임베딩 대신 원문을 재사용 가능한 KV 상태로 인덱싱하고 쿼리 시점에 로컬 LLM이 해당 인덱스에 어텐션을 적용해 증거를 반환하는 구조를 사용한다 저장된 벤치마크 스크립트와 결과를 함께 공개해 재현 가능한 성능 지표를 제공한다
Ornith-1.0 공개: 에이전트형 코딩을 위한 Self-Scaffolding LLM
Qwen3-TTS 최적화 및 Reachy Mini 음성 스택 구축 사례
Qwen3.5 소개: 개요, vLLM 및 llama.cpp 활용 가이드
로컬 LLM 실전 활용 가이드: 2026년 4월 기준 최적의 모델과 설정법
구형 노트북에서 Qwen3.5 실행하기: 경량 로컬 에이전트 AI 구축 가이드
ChatterUI 베타 버전 공개: Gemma 4 지원 및 모바일 성능 테스트 결과
Qwen3.5 35B A3B 모델 수정 및 Claude Opus 데이터셋 기반 파인튜닝 버전 공개
Qwen 3.5 로컬 실행 시 도구 호출 및 에이전트 성능 저하를 해결하는 4가지 핵심 버그와 수정 가이드
Gamma4와 Qwen 3.5의 비디오 캡셔닝 성능 비교 테스트 결과
llama.cpp 서버에서 이미지 세부 묘사 개선을 위한 --image-min-tokens 최적화 팁
Qwen3.5-9B 기반 에이전트 특화 모델 Harmonic-9B 및 필터링된 데이터셋 공개
Artificial Analysis 벤치마크 기반 Gemma 4 E4B 및 Qwen3.5 성능 비교 분석
Qwen 3.5 모델의 도구 호출 오류 해결을 위한 시스템 프롬프트 팁
로컬 Qwen 3.5 122B 환경에서의 토큰 낭비 실측 및 최적화 결과
Gemma 4 vs Qwen 3.5: 프론트엔드 생성 및 벤치마크 비교 분석
CODEC: Mac을 음성 제어 AI 워크스테이션으로 변환하는 오픈소스 로컬 AI 프레임워크
30일간 로컬 LLM을 상시 가동 백그라운드 작업자로 운영한 실험 결과
LLM의 '망상적 나선' 실험: 모델은 왜 사용자의 근거 없는 믿음에 동조하는가?
ByteShape Qwen 3.5 9B: 하드웨어에 맞는 최적의 양자화 모델 선택 가이드
← 피드로 돌아가기
Qwen3.5
Language Models (대형 언어 모델)
약 120개 아티클
관련 태그:
llama.cpp
GGUF
Unsloth
Alibaba
MoE
Gemma 4
Qwen
MLX
RTX 3090
vLLM