본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled

텍스트 생성 및 논리적 추론35Bapache-2.0

Qwen3.6-35B-A3B 모델을 기반으로 Claude 4.7 Opus의 사고 과정을 증류하여 복잡한 논리 추론 성능을 극대화한 모델이다.

학습 방식 · Qwen3.6-35B-A3B 기반 LoRA + Claude 4.7 Opus 추론 데이터셋 지식 증류 학습

핵심 포인트

  • MoE 구조를 통한 35B 규모 대비 빠른 추론 속도
  • Claude 4.7 Opus 수준의 고도화된 사고의 사슬(CoT) 재현
  • Unsloth 최적화로 메모리 사용량 절감
  • 복잡한 논리 추론

88

LIKES

91.1k

DOWNLOADS

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.