본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

stepfun-ai/Step-3.7-Flash

이미지-텍스트 멀티모달 대화 및 이해apache-2.0

Step-3.7-Flash는 MoE 아키텍처를 적용하여 이미지와 텍스트를 효율적으로 처리하는 멀티모달 비전-언어 모델입니다.

핵심 포인트

  • 이미지 기반 텍스트 생성
  • 멀티모달 대화
  • 시각적 정보 분석

367

LIKES

50.2k

DOWNLOADS

3 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.