본문으로 건너뛰기

2026년 2월 25일 AI 뉴스

5

관심 태그 추가

Qwen 모델 성능 저하 없이 일반 지시 모드로 사용하는 최적화 팁

llama.cpp 서버 환경에서 Qwen 모델의 사고 기능을 끄고 성능을 유지하면서 일반 지시 모드에 최적화된 파라미터 설정 방법을 공유합니다.

유행하는 세맨틱 청킹의 배신? 실험으로 증명된 가장 강력한 RAG 청킹 전략

7가지 RAG 청킹 전략을 비교 실험한 결과, 복잡한 최신 기법보다 512 토큰 단위의 재귀적 문자 분할(Recursive Character Splitting)이 가장 높은 정확도를 보였습니다.

512MB RAM 제한을 극복하고 Render 무료 티어에서 RAG 시스템을 구축하는 방법

Render의 512MB RAM과 비휘발성 디스크 환경에서 ChromaDB와 LangChain을 활용해 RAG 시스템을 구축하며 겪은 기술적 제약과 이를 극복하기 위한 최적화 과정을 공유합니다.

모델 학습 없이 고품질 이미지 마스크를 생성하는 Segment Anything 활용법

별도의 모델 학습이나 레이블링 없이 Segment Anything Model(SAM)을 사용하여 커스텀 데이터셋의 고품질 이미지 마스크를 생성하는 전체 워크플로우를 소개합니다.

라벨링 노가다 끝! SAM으로 학습 없이 고품질 마스크 생성하기

별도의 모델 학습이나 라벨링 없이 Segment Anything Model(SAM)을 사용하여 커스텀 이미지에서 고품질 세그멘테이션 마스크를 생성하는 자동화 워크플로우를 소개합니다.