관련 기사 바로가기
LoRA 하이퍼파라미터 자동 탐색 도구 오픈소스 공개: Llama 8B에서 70B로의 성능 전이 확인LLM 아키텍처 갤러리: GPT-2부터 최신 MoE 및 하이브리드 모델까지의 진화QORA-LLM-2B: 순수 Rust로 구현된 BitNet b1.58 기반 3진법 추론 엔진단순 작업은 저가 모델로 라우팅하여 LLM API 비용을 절감하는 프록시 게이트웨이EDGE: Fresta Lens 프레임워크 기반 도메인 평가 렌즈 생성기연준(FOMC) 성명서의 통화 정책 기조 해독을 위한 대형 언어 모델 기반의 델타 일관성 점수화 기법AI의 중심축 이동: 거대 모델 학습에서 대규모 추론으로20,000개의 GPU를 건강하게 유지하는 방법: Modal의 GPU 신뢰성 시스템책임감 있는 AI를 위한 시각적 및 알고리즘적 해석: 안전성, 취약점 및 교육 도구스탠포드 CS221: 언어 모델(Language Models)의 원리와 발전ReMix: LLM 파인튜닝을 위한 Mixture-of-LoRAs의 강화학습 기반 라우팅생산 환경 수준의 Ollama 통합: RabbitMQ와 .NET을 활용한 이벤트 기반 아키텍처소형 언어 모델(SLM)의 추론 능력 진화: 예진 최 교수와의 대담오픈 웨이트 모델의 프리필(Prefill) 공격에 대한 대규모 실증 연구: 50개 모델 모두 취약성 노출nanollama — Llama 3 모델을 처음부터 직접 학습시키는 프레임워크B-Llama3-o 개발 회고: 멀티모달 월드 모델과 인디 개발자의 도전SSD: 병렬 하드웨어를 활용한 초고속 추론 알고리즘 Speculative Speculative Decoding