본문으로 건너뛰기

Step 3.5 Flash: OpenClaw 에이전트를 위한 196B 오픈소스 MoE 모델

StepFun이 공개한 Step 3.5 Flash는 196B 파라미터 규모의 희소 MoE 모델로, 토큰당 11B 파라미터만 활성화하여 높은 효율성과 강력한 에이전트 추론 성능을 제공한다.

섹션별 상세

01
Step 3.5 Flash는 196B 파라미터 규모의 대형 모델임에도 불구하고 희소 MoE 아키텍처를 통해 추론 효율을 확보했다. 토큰당 11B 파라미터만 활성화함으로써 대규모 모델이 가진 높은 지능 수준과 소형 모델의 빠른 추론 속도를 동시에 구현했다.
02
지능 밀도 측면에서 기존의 거대 모델들과 비교했을 때 우수한 효율성을 보여준다. 제공된 벤치마크 데이터에 따르면 파라미터 수 대비 높은 스코어를 기록하여 자원 대비 성능비가 뛰어난 모델임을 입증했다.
모델 파라미터 수 대비 벤치마크 점수를 나타내는 지능 밀도 차트이다.
ChartStep 3.5 Flash가 다른 대형 모델들보다 적은 파라미터 활성화로도 높은 점수를 기록하며 우측 상단의 'Higher Intelligence Density' 영역에 위치함을 보여준다. 이는 모델의 구조적 효율성이 매우 높음을 시사한다.
03
추론, 코딩, 에이전트 작업 등 다양한 영역에서 프론티어급 성능을 발휘한다. GSM8K, MATH, HumanEval 등 주요 벤치마크에서 기존 오픈소스 모델 및 상용 모델들과 대등하거나 우수한 결과를 나타냈다.
추론, 코딩, 에이전트 등 주요 카테고리별 벤치마크 성능 비교 막대 그래프이다.
ChartGSM8K, MATH, HumanEval 등 다양한 지표에서 Step 3.5 Flash가 경쟁 모델들과 대등하거나 우위인 성능을 내고 있음을 구체적인 수치로 제시한다. 특히 추론과 코딩 영역에서의 강점이 두드러진다.
04
OpenClaw 에이전트 프레임워크와의 네이티브 통합을 지원하여 실무 적용성을 높였다. 멀티 에이전트 추론 및 검색, 검증 워크플로우를 원활하게 수행할 수 있도록 설계되어 복잡한 자율 에이전트 시스템 구축에 최적화되었다.
OpenClaw 프레임워크 내에서 작동하는 멀티 에이전트 추론 인터페이스 스크린샷이다.
ScreenshotMaster Agent가 검색(Search) 및 검증(Verify) 서브 에이전트를 활용하여 복잡한 질문에 답하는 과정을 보여준다. 모델이 실제 에이전트 워크플로우에서 어떻게 구조적으로 활용되는지 시각화한다.
05
파이썬 코드 실행 기능을 결합한 도구 증강 추론(Tool-Augmented Reasoning)에서 성능 향상이 두드러진다. AIME 2025 및 HMMT 2025와 같은 고난도 수학 벤치마크에서 파이썬 실행 기능을 사용할 경우 점수가 유의미하게 상승하는 결과를 보였다.
파이썬 코드 실행 기능 유무에 따른 도구 증강 추론 성능 비교 차트이다.
ChartAIME 2025, HMMT 2025 등 고난도 수학 벤치마크에서 파이썬 도구를 결합했을 때 성능이 최대 99.8점까지 상승함을 보여준다. 이는 모델의 도구 활용 능력이 추론 결과에 미치는 직접적인 영향을 입증한다.

용어 해설

전문가 혼합(MoE)
모델의 전체 파라미터 중 일부 전문가 네트워크만 활성화하여 추론하는 아키텍처이다. 대규모 모델의 지능을 유지하면서도 연산량과 비용을 획기적으로 줄일 수 있어 효율적인 대형 언어 모델 구축에 필수적이다.
희소 모델(Sparse Model)
모든 파라미터를 동시에 사용하지 않고 입력 데이터에 따라 필요한 부분만 선택적으로 사용하는 모델 구조이다. Step 3.5 Flash는 196B 파라미터 중 11B만 사용하여 자원 효율성을 극대화했다.
에이전트 수행 능력(Agentic Performance)
AI 모델이 단순히 텍스트를 생성하는 것을 넘어 도구 사용, 계획 수립, 외부 환경과의 상호작용을 자율적으로 수행하는 능력이다. 복잡한 워크플로우를 해결하는 에이전트 시스템의 핵심 지표이다.
지능 밀도(Intelligence Density)
모델의 전체 파라미터 수 대비 발휘하는 벤치마크 성능의 효율성을 의미한다. 파라미터가 적으면서도 높은 점수를 기록할수록 지능 밀도가 높다고 평가하며 운영 효율성이 우수함을 시사한다.

기술

  • Step 3.5 Flash
  • OpenClaw
  • Python
  • MoE Architecture

활용 사례

  • 자율 AI 에이전트 구축
  • 복잡한 수학 및 논리 추론 시스템
  • 멀티 에이전트 협업 워크플로우
  • 비용 효율적인 대규모 LLM 서비스

언급된 리소스

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 03. 05.수집 2026. 03. 06.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.