Google이 공개한 차세대 제로샷 이미지 분류 모델 TIPSv2
제로샷 이미지 분류 및 특징 추출apache-2.0
대조 학습 기반의 이미지-텍스트 정렬을 통해 학습하지 않은 객체도 텍스트 설명만으로 분류할 수 있는 Vision 모델이다.
핵심 역량
- 제로샷 이미지 분류
- 이미지 특징 추출
- 이미지-텍스트 유사도 측정
- 시각적 임베딩 생성
강점
- 학습 데이터에 없는 클래스에 대한 제로샷 추론 가능
- Apache 2.0 라이선스로 자유로운 배포 및 수정 허용
- Safetensors 적용으로 모델 로딩 보안성 강화
훈련 방식
TIPSv2 아키텍처 기반의 대조 학습(Contrastive Learning)을 통한 이미지-텍스트 정렬 학습
알아두면 좋은 것
- Apache 2.0 라이선스로 상업적 이용 가능
- Transformers 라이브러리와의 호환성 제공
- Safetensors 포맷을 통한 안전한 가중치 로드 지원
- Google 연구팀에 의해 개발된 TIPSv2 아키텍처 적용
53
Likes
4.9k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.