본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
온프렘 LLM 서비스 운영의 고성능 오케스트레이션과 비용 절감: llm-d의 다중 벤더 GPU 활용
AWS, llm-d 기반의 LLM 분산 추론(Disaggregated Inference) 기능 발표
← 피드로 돌아가기
llm-d
Libraries (AI 라이브러리)
약 3개 아티클
관련 태그:
vLLM
AWS
IBM
KV-cache
Llama-3.1