facebook/sapiens2
인체 포즈 추정, 신체 분할, 표면 법선 추정 및 깊이 예측other
Meta에서 개발한 인간 중심 비전 태스크에 최적화된 차세대 Vision Transformer 기반 파운데이션 모델이다.
학습 방식 · Vision Transformer 기반 대규모 인간 중심 데이터셋 사전 학습 및 다중 태스크 파인튜닝
핵심 포인트
- 인간 중심 비전 태스크에서 기존 SOTA 모델 대비 정밀한 분석 성능 제공
- 단일 아키텍처로 포즈, 분할, 법선 등 다양한 인간 분석 기능 통합
- 2D 인체 포즈 추정
- 신체 부위별 시맨틱 분할
120
LIKES
0
DOWNLOADS
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.