StepFun이 공개한 고효율 멀티모달 비전-언어 모델 Step-3.7-Flash
이미지-텍스트 멀티모달 대화 및 이해apache-2.0
Step-3.7-Flash는 MoE 아키텍처를 적용하여 이미지와 텍스트를 효율적으로 처리하는 멀티모달 비전-언어 모델입니다.
핵심 역량
- 이미지 기반 텍스트 생성
- 멀티모달 대화
- 시각적 정보 분석
알아두면 좋은 것
- Apache 2.0 라이선스 적용
- MoE 아키텍처를 통한 효율적 추론
- transformers 프레임워크 지원
367
Likes
50.2k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.