본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
긴 추론을 위한 정보 인지형 KV 캐시 압축(InfoKV)
Llama 3.1 8B(QLoRA)로 고전 작품 파인튜닝 후 인용 정확성 문제와 RAG 적용 경험
Amazon FSx for Lustre와 GDS를 활용한 LLM 모델 로딩 가속화 및 컨텍스트 윈도우 확장
LangChain과 Llama 3.1을 활용한 동적 라우팅 기반 연구 요약 엔진 구축
적대적인 사용자 프롬프트가 LLM의 지시 이행 성능을 저하시킨다는 연구 결과
NVIDIA의 멀티 에이전트 쇼핑 어시스턴트와 Shopware 6 통합 사례
MIT 연구진, LLM 메모리 병목 해결을 위한 50배 KV 캐시 압축 기술 'Attention Matching' 공개
OBLITERATUS: 대형 언어 모델의 거부 행동 분석 및 제거를 위한 오픈소스 툴킷
SageMaker AI 엔드포인트에 호스팅된 LLM을 위한 Strands 에이전트용 커스텀 모델 공급자 구축
Taalas HC1, Llama 3.1 8B 모델에서 초당 16,960 토큰 추론 성능 달성
로컬 LLM을 평가 판사로 활용하기 위한 모델 비교 및 팁
로컬 LLM을 위한 신뢰도 평가기 구축 실험: Autodidact 프레임워크
LLM 에이전트를 위한 3계층 기억 체계(의미, 일화, 절차 기억) 구현 사례
Llama 3.1, Neo4j, LangChain을 활용한 GPU 없는 완전 로컬 GraphRAG 파이프라인 구축
대형 언어 모델(LLM) 디렉토리: 500개 이상의 AI 에이전트 및 모델 목록
2019 Mac Pro를 1.5TB RAM으로 업그레이드하여 Llama 3.1 405B를 실행하는 것이 효율적일까요?
Gemini 3.1 Pro의 벤치마크 석권과 10배 빠른 하드웨어 가속 모델의 등장
Amazon SageMaker AI 2025 연말 결산 2부: 관측성 개선 및 모델 커스터마이징·호스팅 기능 강화
Taalas, Llama 3.1 8B 모델을 초당 17,000 토큰으로 구동하는 전용 하드웨어 발표
대형 언어 모델의 동기 부여 연구
← 피드로 돌아가기
Llama-3.1
Language Models (대형 언어 모델)
약 52개 아티클
관련 태그:
Taalas
Mistral
DeepSeek-R1
vLLM
Qwen
Hugging Face
H100
IFEval
Arc Sentry
DPO