r/LocalLLaMA5달 전
Qwen 모델 성능 저하 없이 일반 지시 모드로 사용하는 최적화 팁
llama.cpp 서버 환경에서 Qwen 모델의 사고 기능을 끄고 성능을 유지하면서 일반 지시 모드에 최적화된 파라미터 설정 방법을 공유합니다.
총 5건
llama.cpp 서버 환경에서 Qwen 모델의 사고 기능을 끄고 성능을 유지하면서 일반 지시 모드에 최적화된 파라미터 설정 방법을 공유합니다.
7가지 RAG 청킹 전략을 비교 실험한 결과, 복잡한 최신 기법보다 512 토큰 단위의 재귀적 문자 분할(Recursive Character Splitting)이 가장 높은 정확도를 보였습니다.
별도의 모델 학습이나 레이블링 없이 Segment Anything Model(SAM)을 사용하여 커스텀 데이터셋의 고품질 이미지 마스크를 생성하는 전체 워크플로우를 소개합니다.
별도의 모델 학습이나 라벨링 없이 Segment Anything Model(SAM)을 사용하여 커스텀 이미지에서 고품질 세그멘테이션 마스크를 생성하는 자동화 워크플로우를 소개합니다.