본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

Jackrong/Qwen3.5-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled

텍스트 생성 및 복합 추론 (Chain-of-Thought)35Bapache-2.0

Qwen 3.5 MoE 아키텍처에 고성능 추론 데이터셋을 증류하여 한국어와 다국어 논리 추론 성능을 극대화한 모델입니다.

학습 방식 · Qwen 3.5 35B MoE 기반, Claude 추론 데이터셋(Opus-4.6-Reasoning)을 활용한 지식 증류 및 Unsloth 최적화 학습

핵심 포인트

  • Claude급 고난도 추론 데이터 증류를 통한 논리 성능 확보
  • MoE 아키텍처를 통한 추론 속도 및 효율성 개선
  • 한국어 데이터셋 필터링을 통한 로컬 언어 이해도 향상
  • 단계별 사고(Chain-of-Thought) 추론

73

LIKES

4.5k

DOWNLOADS

1 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.