unsloth/DeepSeek-V4-Flash-0731-GGUF
장기 에이전틱 코딩에 특화된 DeepSeek-V4-Flash 정식판을 llama.cpp로 서빙하기 위한 GGUF 양자화 배포판mit
DeepSeek-V4-Pro를 능가하는 DeepSeek-V4-Flash 정식판의 llama.cpp GGUF 배포판
TL;DR
DeepSeek-V4-Flash-0731은 프리뷰 버전을 대체하는 정식 릴리스로, DeepSeek-V4-Flash-DSpark와 같은 구조에 추론적 디코딩 모듈을 얹어 활성 파라미터가 훨씬 적음에도 DeepSeek-V4-Pro(프리뷰)를 앞선다. Terminal Bench 2.1 82.7·NL2Repo 54.2·Cybergym 76.7·DeepSWE 54.4 등 에이전틱 코딩 벤치마크에서 프리뷰 대비 큰 폭으로 개선돼 GLM-5.2와 맞먹거나 앞서는 수준까지 올라왔다. 이 저장소는 Unsloth Dynamic 2.0 GGUF 양자화 배포판으로, 카드가 완전 정밀도 무손실로 소개하는 Q8(UD-Q8_K_XL, 162GB)이 Q4(UD-Q4_K_XL)보다 7GB밖에 크지 않아 정밀도를 골라 로컬 서빙할 수 있다. 위 벤치마크는 원본 모델 수치이며 양자화판을 따로 측정한 값은 아니다. MIT 라이선스로 배포돼 상업적 사용에도 제약이 없다.
핵심 포인트
- DeepSeek-V4-Flash 프리뷰를 대체하는 공식 정식판으로, 활성 파라미터가 훨씬 적음에도 DeepSeek-V4-Pro(프리뷰)를 앞선다.
- Terminal Bench 2.1·NL2Repo·Cybergym·DeepSWE 등 에이전틱 코딩 벤치마크에서 프리뷰 대비 큰 폭으로 개선됐다.
- DeepSeek-V4-Flash-DSpark와 동일한 구조로 추론적 디코딩 모듈이 함께 장착돼 있다.
- Unsloth Dynamic 2.0 GGUF로 제공되며 카드 기준 Q8(162GB)이 Q4보다 7GB 큰 정도라 정밀도 선택 부담이 작다.
벤치마크
| 벤치마크 | 지표 | 값 | 비교 |
|---|---|---|---|
| Terminal Bench 2.1 | score | 82.7 | DeepSeek-V4-Flash Preview 61.8, DeepSeek-V4-Pro Preview 72.1, GLM-5.2 81.0 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님 |
| NL2Repo | score | 54.2 | Preview 39.4 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님 |
| Cybergym | score | 76.7 | Preview 38.7 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님 |
| DeepSWE | score | 54.4 | Preview 7.3 — 기반 모델 DeepSeek-V4-Flash-0731의 공개 수치, GGUF 양자화 버전 측정치 아님 |
676
LIKES
289.6k
DOWNLOADS
4 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.