본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

tencent/Penguin-VL-8B

멀티모달 텍스트 생성 및 이미지 이해8Bapache-2.0

Qwen3-8B 모델에 시각 인코더를 결합하여 이미지 이해와 텍스트 생성을 동시에 수행하는 멀티모달 모델이다.

핵심 포인트

  • 8B 파라미터 규모의 경량화된 멀티모달 추론
  • Qwen3-8B 기반의 고성능 언어 생성 능력
  • 이미지 입력을 지원하는 비전 인코더 통합 아키텍처
  • Apache-2.0 라이선스 기반의 상업적 이용 지원

65

LIKES

3.2k

DOWNLOADS

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.