본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
FlexiSLM: 동적이고 제어 가능한 프레임 레이트 음성 언어 모델
향상된 대형 언어 확산 모델
브라우저·GUI 에이전트에서 그라운딩 벤치마크가 실패를 숨긴 사례와 LoRA 파인튜닝 한계
D2F: 디스크리트 디퓨전 포싱을 통한 AR보다 빠른 Diffusion LLM 추론
Qwen2.5-1.5B와 QLoRA를 활용한 영어 CEFR 숙련도 분류 모델 구축
5,000줄의 파이썬으로 구현한 원칙적인 ML 컴파일러 스택
Doxa 엔진을 활용한 호르무즈 해협 지정학적 시뮬레이션 및 에이전트 창발 분석
인간의 설계 없이 스스로 진화하는 추론 구조: DAG 기반 자동 추론 전략 탐색 연구
Raspberry Pi 5에서 로컬 LLM을 활용한 RSS 블로그 요약 도구
임베딩 분산은 다의성이 아니라 빈도에 의해 결정된다: '문맥적 혼잡 지수(CPI)' 제안
로컬 LLM을 위한 신뢰도 평가기 구축 실험: Autodidact 프레임워크
Qwen 2.5의 내부 감정 처리 메커니즘 분석: Activation Lab 실험 결과
초기화가 분지를 결정한다: 극한의 LLM 양자화를 위한 효율적인 코드북 최적화
Faithful GRPO: 제약 조건 정책 최적화를 통한 멀티모달 언어 모델의 시각적 공간 추론 능력 향상
PyVision-RL: 강화학습을 통한 개방형 에이전트 시각 모델 구축
에이전트 메모리 시스템의 해부: 분류 체계 및 평가와 시스템 한계에 대한 실증적 분석
확률 심플렉스 상의 최적화로서의 디코딩: Top-K, Top-P에서 Best-of-K 샘플러까지
DODO: 이산 OCR 확산 모델
Qwen2.5-0.5B-Instruct 모델의 GSM8K 추론 튜닝 중 발생한 리워드 해킹 사례
AdaptToken: MLLM의 긴 비디오 이해를 위한 엔트로피 기반 적응형 토큰 선택 기술
← 피드로 돌아가기
Qwen2.5
Language Models (대형 언어 모델)
약 89개 아티클
관련 태그:
GRPO
llama.cpp
PyTorch
Qwen
MCP
Gemini 2.5 Pro
KV-cache
GPT-4o
Llama 3.2
Chain of Thought