로컬 LLM 컨텍스트 128k의 함정: 70%만 차도 망각이 시작된다
Qwen 2.5:14B 모델을 로컬 자동화에 활용하며 발견한 컨텍스트 품질 저하 문제와 이를 해결하기 위한 공격적인 프루닝 및 스트리밍 최적화 방법을 공유합니다.
총 3건
Qwen 2.5:14B 모델을 로컬 자동화에 활용하며 발견한 컨텍스트 품질 저하 문제와 이를 해결하기 위한 공격적인 프루닝 및 스트리밍 최적화 방법을 공유합니다.
터미널에서 긴 마크다운 문서를 리뷰할 때 발생하는 불편함을 해결하기 위해 GitHub 방식의 댓글 작성과 변경 사항 비교 기능을 제공하는 도구 Crit이 출시되었습니다.
강화학습 알고리즘인 PPO를 활용하여 아무런 사전 지식 없이 게임 화면의 픽셀 정보만으로 마리오 게임을 스스로 학습하고 클리어하는 AI 봇 프로젝트입니다.