Google Gemma 4의 등장, 텍스트와 이미지를 하나로 묶는 Any-to-Any 모델
멀티모달 텍스트 및 이미지 생성4Bapache-2.0
텍스트와 이미지를 자유롭게 입력받고 생성할 수 있는 Google Gemma 4 시리즈의 4B 규모 멀티모달 지시어 미세조정 모델이다.
핵심 역량
- 텍스트 기반 질의응답
- 이미지 내용 분석 및 설명
- 멀티모달 지시어 이행
- 대화형 인터페이스 지원
강점
- Apache 2.0 라이선스로 상업적 이용 가능
- 텍스트와 이미지를 통합 처리하는 Any-to-Any 유연성
훈련 방식
Gemma 4 기반 Any-to-Any 멀티모달 사전 학습 및 지시어 미세조정
알아두면 좋은 것
- Apache 2.0 라이선스 기반의 오픈 소스 모델
- 텍스트와 이미지를 넘나드는 Any-to-Any 기능 탑재
- Transformers 라이브러리 공식 지원
- 미국 지역 엔드포인트와 호환 가능
1.2k
Likes
6.4M
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.