본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
KeyFrame-Compass: 키프레임 조건화 비디오 생성의 포괄적 벤치마크와 자동화 평가 프레임워크
시각화가 추론의 첫 단계일 때: 시각적 사고의 사슬(Visual CoT)을 위한 벤치마크 MIRA
FORGE: 제조 시나리오를 위한 세밀한 멀티모달 평가 벤치마크
JoyAI-Image: 지시어 기반 이미지 편집을 위한 24B 규모 멀티모달 모델 공개
실시간 음성에서 감정, 의도 및 생체 정보를 추출하는 하이브리드 접근 방식
Agentic-MME: 멀티모달 지능에서 에이전트 능력이 실제로 가져오는 변화는 무엇인가?
HippoCamp: 개인용 컴퓨터에서의 컨텍스트 기반 에이전트 벤치마킹
ECG-Reasoning-Benchmark: 심전도 해석의 임상적 추론 능력 평가를 위한 벤치마크
MM-CondChain: 시각적 근거 기반 심층 조합 추론을 위한 프로그래밍 검증 벤치마크
← 피드로 돌아가기
MLLM
Language Models (대형 언어 모델)
약 9개 아티클
관련 태그:
Gemini 3 Pro
ASR
ECG-Reasoning-Benchmark
FORGE
GPT-4o
HippoCamp
JoyAI-Image
KeyFrame-Compass
MIRA
MM-CondChain