본문으로 건너뛰기

관련 기사 바로가기

Insight-V++: 멀티모달 대형 언어 모델을 활용한 고도화된 롱체인 시각적 추론을 향하여이산 기호 이해를 위한 멀티모달 대형 언어 모델의 인지적 불일치틴티드 프레임: 질문 프레이밍이 시각-언어 모델의 시각적 인지를 방해하는 현상 분석상호 보완적 강화 학습: LLM 에이전트를 위한 정책과 경험의 동시 진화Video-CoE: 사건 사슬을 통한 비디오 사건 예측 강화시간적 이득, 공간적 비용: 멀티모달 대형 언어 모델의 비디오 파인튜닝 재검토수동적 관찰자에서 능동적 비평가로: 로봇 조작을 위한 프로세스 추론을 유도하는 강화학습DataFlow: 데이터 중심 AI를 위한 LLM 데이터 생성 및 정제 통합 프레임워크Chat Daddy: Rust로 구축한 7.4MB 초경량 AI 대화 통합 관리 도구PhysicEdit: 물리 법칙을 준수하는 이미지 편집 AI 모델Flux.2와 Qwen 2.5를 활용한 실사-애니메이션 변환 파이프라인 최적화Zyora-Dev의 zse v1.3.1 출시: 24GB GPU에서 32B 모델 실행 지원CVPR 2026에서 개최되는 Roboflow-20VL 파운데이션 모델 퓨샷 객체 탐지 챌린지병렬 토큰 예측을 통한 효율적인 문서 파싱VISIONCOACH: 시각적 지각 프롬프팅을 통한 근거 기반 비디오 추론 강화Roboflow, 시각적 비전 파이프라인 구축을 위한 Workflows Builder 2.0 출시대규모 GPU 클러스터를 활용한 파운데이션 모델 분산 학습 가이드결함 발견 및 수정: 에이전트 기반 데이터 합성을 통한 VLM 및 확산 모델의 시각적 아티팩트 이해력 강화LongVideo-R1: 저비용 장편 비디오 이해를 위한 스마트 내비게이션OmniLottie: 파라미터화된 Lottie 토큰을 통한 벡터 애니메이션 생성
← 피드로 돌아가기

Qwen2.5

Language Models (대형 언어 모델)

89개 아티클

관심 태그 추가
TIMEHEADLINE