본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

unsloth/DeepSeek-V4-Flash-0731-GGUF

장기 에이전틱 코딩에 특화된 DeepSeek-V4-Flash 정식판을 llama.cpp로 서빙하기 위한 GGUF 양자화 배포판mit

DeepSeek-V4-Pro를 능가하는 DeepSeek-V4-Flash 정식판의 llama.cpp GGUF 배포판

TL;DR

DeepSeek-V4-Flash-0731은 프리뷰 버전을 대체하는 정식 릴리스로, DeepSeek-V4-Flash-DSpark와 같은 구조에 추론적 디코딩 모듈을 얹어 활성 파라미터가 훨씬 적음에도 DeepSeek-V4-Pro(프리뷰)를 앞선다. Terminal Bench 2.1 82.7·NL2Repo 54.2·Cybergym 76.7·DeepSWE 54.4 등 에이전틱 코딩 벤치마크에서 프리뷰 대비 큰 폭으로 개선돼 GLM-5.2와 맞먹거나 앞서는 수준까지 올라왔다. 이 저장소는 Unsloth Dynamic 2.0 GGUF 양자화 배포판으로, 카드가 완전 정밀도 무손실로 소개하는 Q8(UD-Q8_K_XL, 162GB)이 Q4(UD-Q4_K_XL)보다 7GB밖에 크지 않아 정밀도를 골라 로컬 서빙할 수 있다. 위 벤치마크는 원본 모델 수치이며 양자화판을 따로 측정한 값은 아니다. MIT 라이선스로 배포돼 상업적 사용에도 제약이 없다.

핵심 포인트

  • DeepSeek-V4-Flash 프리뷰를 대체하는 공식 정식판으로, 활성 파라미터가 훨씬 적음에도 DeepSeek-V4-Pro(프리뷰)를 앞선다.
  • Terminal Bench 2.1·NL2Repo·Cybergym·DeepSWE 등 에이전틱 코딩 벤치마크에서 프리뷰 대비 큰 폭으로 개선됐다.
  • DeepSeek-V4-Flash-DSpark와 동일한 구조로 추론적 디코딩 모듈이 함께 장착돼 있다.
  • Unsloth Dynamic 2.0 GGUF로 제공되며 카드 기준 Q8(162GB)이 Q4보다 7GB 큰 정도라 정밀도 선택 부담이 작다.

벤치마크

벤치마크지표비교
Terminal Bench 2.1score82.7DeepSeek-V4-Flash Preview 61.8, DeepSeek-V4-Pro Preview 72.1, GLM-5.2 81.0 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님
NL2Reposcore54.2Preview 39.4 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님
Cybergymscore76.7Preview 38.7 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님
DeepSWEscore54.4Preview 7.3 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님

676

LIKES

289.6k

DOWNLOADS

4 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.