TL;DR
Anthropic은 코딩과 지식 작업을 겨냥한 Claude Fable 5.1과 Claude Mythos 5.1을 출시했으며, Fable 5.1은 Artificial Analysis Intelligence Index에서 66점을 기록해 당시 최고 점수에 올랐습니다. 입력과 출력의 기본 가격은 유지했지만 Cache Read 가격을 75% 낮췄고, Terminal-Bench-Science 0.1에서는 Fable 5의 24.7%를 넘어 52.6%를 기록했습니다. 다만 출력 토큰 사용량이 약 1.7배 늘어 작업당 비용은 오히려 20% 증가했으며, 평가 요청의 약 4%가 Fallback 모델로 처리돼 순수한 기본 모델 성능을 해석하기 어려웠습니다. 사용자는 코딩 능력과 문체 개선을 높이 평가했지만 Rate Limit, 안전장치 오탐, Fable과 Mythos의 라우팅 차이에 대해서는 엇갈린 반응을 보였습니다. 같은 기간 OpenAI Astra, World Labs Atlas, Qwen3.8-Max-0902와 Agent Harness·Memory 연구가 함께 부상하면서 모델 경쟁의 초점이 단일 모델 점수에서 비용, 안전 제어, 실행 환경을 포함한 시스템 성능으로 이동했습니다.
섹션별 상세

용어 해설
- 캐시 읽기 가격(Cache Read Pricing)
- — 반복 요청에서 이미 저장된 입력 토큰을 다시 읽을 때 부과되는 비용입니다. Agent가 긴 문맥과 도구 기록을 여러 차례 재사용하는 환경에서는 전체 입력 비용에 큰 영향을 주며, 이번 출시에서는 1M 토큰당 $1.00에서 $0.25로 75% 낮아졌습니다.
- Fallback Routing
- — 안전 분류나 특정 조건에 따라 기본 모델의 요청을 다른 모델로 넘기는 처리 방식입니다. 이번 평가에서는 안전 플래그가 붙은 요청 일부가 Claude Opus 4.8 또는 Claude Opus 5로 전달됐고, 출력 토큰의 약 4%가 이 경로에서 처리됐습니다.
- Agentic Workload
- — 모델이 한 번의 답변에 그치지 않고 계획 수립, 코드 실행, 도구 호출, 결과 점검을 여러 단계로 이어가는 작업입니다. 이런 환경에서는 출력 토큰 수와 긴 입력의 캐시 재사용률, 장시간 실행 안정성이 작업당 비용과 성능을 함께 좌우합니다.
- Enterprise Frontier Safeguards
- — 기업 환경에서 Agent의 활동을 관찰하고 위험 신호를 관리하기 위한 Anthropic의 안전 제어 계층입니다. 교차 세션 관찰과 이상 징후 감시를 제공해 장기 실행 Agent의 배포 가능성을 높이려 하지만, 사용자는 이 과정에서 과도한 거부나 오탐을 경험할 수 있습니다.
- Recurrent Depth
- — Transformer 블록이나 계산 경로를 반복 실행해 파라미터와 저장 공간을 절약하면서 유효 계산 깊이를 늘리는 구조적 방식입니다. Astra를 둘러싼 논쟁에서는 이 구조가 Chain-of-Thought 모니터링과 사고 과정의 사후 조사를 어렵게 만들 수 있는지가 핵심 쟁점으로 떠올랐습니다.
기술
- Claude Fable 5.1
- Claude Mythos 5.1
- Claude Opus 4.8
- Claude Opus 5
- GPT-5.6 Sol
- World Labs Atlas
- OpenAI Astra
- Qwen3.8-Max-0902
- GLM-5.3
- DeepSeek-V4-Pro-0813
- RWKV-7 G1j
- LongCat-2.0
- vLLM-Omni
- FastVideo
- FastH3
- Blender
- OpenRouter
- Cline
활용 사례
- 장기 실행 코딩 Agent
- 과학 연구 자동화
- 지식 작업과 비즈니스 워크플로 자동화
- 저장소와 도구 기록을 재사용하는 Multi-step Agent
- 이미지 기반 주택 설계와 3D Walkthrough 생성
- 소수의 사진을 이용한 장면 재구성과 Robotics용 Real2Sim
- 전자상거래 운영 Agent 평가
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
