본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Qwen-Image-2.0 기술 보고서
JoyAI-Image: 통합 멀티모달 이해 및 생성을 통한 공간 지능의 각성
JoyAI-Image: 지시어 기반 이미지 편집을 위한 24B 규모 멀티모달 모델 공개
SkyReels-V4: 멀티모달 비디오-오디오 생성, 인페인팅 및 편집 모델
InternVL-U: 이해, 추론, 생성 및 편집을 위한 통합 멀티모달 모델의 대중화
← 피드로 돌아가기
Multimodal Diffusion Transformer
Architecture (AI 아키텍처)
약 5개 아티클
관련 태그:
JoyAI-Image
Flow Matching
InternVL
MLLM
MMLM
Qwen3-VL
Qwen-Image-2.0
SkyReels-V4
Chain of Thought
Skywork AI