본문으로 건너뛰기

관련 기사 바로가기

MiniMax-H3를 행동 가능한 월드 모델로 전환NoRA로 LoRA의 입력 투영 규모를 정규화하다Bubble 없이 추론 흔적을 복원하는 Trace-Inverter-4B 공개LLM 가중치를 ROM 카트리지에 담자는 제안math_code_hallucination: 수학과 코드가 결합될 때 LLM이 복잡한 수학적 요소를 단순 계산 대체물로 바꾸는 사례 기록theprint/auto-sft — LoRA 파인튜닝 자동화 파이프라인SRM-LoRA: 민감도 기반 리만 계량을 이용한 LoRA 업데이트로 LLM 환각 완화작은 LLM의 추론을 코드 검증 단계로 나눈 실험NVIDIA FLARE로 구현한 멀티모달 연합 학습같은 유효 배치에서도 실제 배치가 T4 학습 속도를 좌우Nebius Serverless AI 챌린지 수상작과 실측 결과TwIL-LM의 1차 논리 변환 특화Kimi K3의 LoRA 대 FullFT 비교스마트폰에서 동작하는 소형 모델 관리 인터페이스 공개와 32B 교사 모델 기반 증류 및 130,000개 예시로 1.7B 개선 계획반복 블록을 순환하는 재귀적 깊이 트랜스포머의 길이 외삽성과 테스트 시 계산 전략에 관한 통제된 실험도메인 특화 로컬 LLM을 위한 LoRA 파인튜닝과 로컬 서빙 패턴대형 언어모델에서 하이퍼네트워크 기반 지식 주입의 스케일링 법칙파인튜닝은 여전히 필요한가? 현대 AI 워크플로우를 위한 의사결정 프레임워크aglio-lab의 ai-evaluation-tools: 300개 이상 AI 평가 도구 목록 공개From RGB Generation to Dense Field Readout: 텍스트-투-이미지 백본에서 직접 픽셀-정렬 밀집 예측을 읽어내는 ReChannel
← 피드로 돌아가기

LoRA

Training (학습/파인튜닝)

228개 아티클

관심 태그 추가
TIMEHEADLINE