본문으로 건너뛰기

관련 기사 바로가기

WorldCache: 가속화된 비디오 월드 모델을 위한 콘텐츠 인식 캐싱SAMA: 지시어 기반 비디오 편집을 위한 분해된 시맨틱 앵커링 및 모션 정렬MolmoBot: 대규모 시뮬레이션을 통한 제로샷 로봇 조작 가능성 입증ViFeEdit: 비디오 데이터 없이 비디오 디퓨전 트랜스포머를 튜닝하는 비디오 프리 튜너조건부 가이드 스케줄링 기반 하이브리드 데이터-파이프라인 병렬 처리를 통한 디퓨전 모델 가속화WILDACTOR: 제약 없는 신원 보존형 비디오 생성Solaris: 마인크래프트에서의 멀티플레이어 비디오 월드 모델 구축장편 비디오 생성을 위한 모드 탐색과 평균 탐색의 결합: 빠른 고품질 영상 생성 패러다임HiFi-Inpaint: 세밀한 디테일 보존형 인물-상품 이미지 생성을 위한 고정밀 참조 기반 인페인팅Kling-MotionControl 기술 보고서: 적응형 전신 캐릭터 애니메이션을 위한 이종 모션 조율Just-in-Time: 확산 트랜스포머를 위한 학습이 필요 없는 공간 가속화 기법EndoCoT: 디퓨전 모델의 내생적 사고 사슬 추론 확장CaTok: 1차원 인과적 이미지 토큰화를 위한 Mean Flows 제어동적 청킹 확산 트랜스포머하나의 모델, 다양한 예산: 확산 트랜스포머를 위한 탄력적 잠재 인터페이스 (ELIT)Wan2.1/2.2 기반 오픈소스 통합 오디오-비디오 생성 모델(Alive-Wan) 프로젝트 제안음악 장르 변환을 위한 DiT 및 Flow Matching 기반 모델 학습 및 스케일링 조언 요청MIT의 새로운 'Drifting Model' 전체 구현 - 오픈 소스 PyTorch 라이브러리 및 저장소 공개
← 피드로 돌아가기

DiT

Architecture (AI 아키텍처)

38개 아티클

관심 태그 추가
TIMEHEADLINE