관련 기사 바로가기
LTX-Video 카메라 돌리 LoRA 학습 중 텍스트 인코더 및 토크나이저 오류 문제ViFeEdit: 비디오 데이터 없이 비디오 디퓨전 트랜스포머를 튜닝하는 비디오 프리 튜너LTX2EasyPrompt-LD: 10만 단어 라이브러리를 탑재한 ComfyUI용 영상 프롬프트 도구 업데이트MoKus: 지식 인지형 개념 커스터마이징을 위한 교차 모달 지식 전이 활용GlyphPrinter: 글리프 정확도를 위한 영역 그룹화 직접 선호도 최적화 기반 시각적 텍스트 렌더링HSImul3R: 시뮬레이션 가능한 인간-장면 상호작용의 물리 기반 루프 재구성2025년 LLM 현황 보고서: 발전, 문제점 그리고 미래 예측머신러닝과 AI의 시대별 'Hello World' 예제: 2013년부터 2025년까지Claude Code를 활용한 오픈 소스 LLM 파인튜닝 자동화 가이드특정 작업에 특화된 소형 모델 파인튜닝의 이점과 도구Qwen-Image-Edit-2511: 캐릭터 일관성과 기하학적 추론이 강화된 이미지 편집 모델WILDACTOR: 제약 없는 신원 보존형 비디오 생성WeEdit: 텍스트 중심 이미지 편집을 위한 데이터셋, 벤치마크 및 글리프 가이드 프레임워크PureCC: 텍스트-이미지 개념 커스텀을 위한 순수 학습 기법AutoResearch-RL: 자율적 신경망 아키텍처 탐색을 위한 영구적 자기 평가 강화학습 에이전트NLE: 텍스트 편집 기반의 비자기회귀 LLM 음성 인식 시스템ID-LoRA: In-Context LoRA를 활용한 아이덴티티 기반 오디오-비디오 개인화ReMix: LLM 파인튜닝을 위한 Mixture-of-LoRAs의 강화학습 기반 라우팅DVD: 생성형 사전 지식을 활용한 결정론적 비디오 깊이 추정LookaheadKV: 생성 과정 없이 미래를 예측하여 빠르고 정확한 KV 캐시 제거 수행