본문으로 건너뛰기

DeepSeek, GPT-5 및 Gemini 3 Pro에 필적하는 새로운 추론 모델 출시

DeepSeek가 GPT-5 및 Gemini 3 Pro와 경쟁하기 위해 성능을 대폭 향상시킨 오픈소스 추론 모델 DeepSeek-V3.2 시리즈를 출시했다.

섹션별 상세

01
DeepSeek는 추론 중심의 모델인 V3.2와 V3.2-Speciale을 출시했다. AIME 2025, HMMT 2025 등 고난도 수학 경시 대회 벤치마크에서 기존 유료 모델들을 압도하는 성과를 거두었다. 특히 Codeforces 레이팅에서 2700점 이상을 기록하며 최상위권 코딩 능력을 입증했다.
DeepSeek-V3.2 모델과 주요 경쟁 모델들의 벤치마크 성능 비교 차트
ChartDeepSeek-V3.2-Speciale과 Thinking 모델이 AIME 2025, HMMT 2025, Codeforces 등 추론 및 코딩 벤치마크에서 GPT-5-High, Claude-4.5-Sonnet, Gemini-3.0-Pro를 상회하거나 대등한 수치를 기록하고 있음을 보여준다. 특히 수학적 추론(AIME)과 에이전트 능력(SWE Verified) 지표에서 매우 높은 경쟁력을 나타낸다.
02
DeepSeek는 신규 모델의 가중치를 Hugging Face에 공개하여 누구나 접근 가능하게 했다. 이는 폐쇄형 모델 위주의 고성능 추론 시장에서 오픈소스 모델의 경쟁력을 크게 높이는 계기가 된다. 사용자는 DeepSeek 앱뿐만 아니라 자체 인프라에서도 이 모델들을 구동할 수 있다.
03
Mistral AI 또한 새로운 프론티어급 오픈 웨이트 모델과 소형 모델을 출시하며 빅테크 기업들을 추격하고 있다. 또한 AWS의 차세대 학습 칩인 Trainium3와 Runway의 Gen-4.5 소식 등 하드웨어와 멀티모달 분야에서도 경쟁이 동시다발적으로 진행 중이다.

용어 해설

미국 수학 초청 시험 2025(AIME 2025)
고등학생 수준의 고난도 수학 문제를 다루는 벤치마크로, AI 모델의 복잡한 논리적 추론 및 문제 해결 능력을 평가하는 척도로 사용된다.
코드포스 레이팅(Codeforces Rating)
경쟁 프로그래밍 플랫폼인 Codeforces에서 부여하는 실력 지표로, AI 모델이 실시간 코딩 문제 해결에서 인간 전문가 수준에 얼마나 근접했는지 보여준다.
오픈 웨이트 모델(Open-weight Model)
모델의 학습된 가중치를 공개하여 누구나 자신의 인프라에서 모델을 직접 실행하고 튜닝할 수 있게 한 모델 형태로, 기술의 민주화와 보안 유지에 유리하다.

기술

  • DeepSeek-V3.2
  • DeepSeek-V3.2-Speciale
  • Hugging Face
  • GPT-5
  • Gemini 3 Pro

활용 사례

  • 복잡한 수학 문제 해결 시스템
  • 고급 코딩 어시스턴트
  • 논리적 추론이 필요한 에이전트 워크플로우

언급된 리소스

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2025. 12. 08.수집 2026. 02. 21.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.