본문으로 건너뛰기

Claude Fable 5.1과 Mythos 5.1 공개

Anthropic의 새 Claude 모델이 에이전트 작업 비용과 과학 연구 성능을 함께 개선했습니다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

Anthropic은 코딩과 지식 작업을 겨냥한 Claude Fable 5.1과, 동일한 기반 모델에 더 완화된 사이버보안·생명과학 보호장치를 적용한 Claude Mythos 5.1을 공개했습니다. Fable 5.1은 캐시 읽기 가격을 백만 토큰당 $0.25로 낮춰 일반 작업 비용을 Fable 5보다 약 25%, 고도 에이전트 작업은 최대 약 45% 줄였고, 여러 벤치마크에서 이전 모델보다 높은 점수를 기록했습니다. Mythos 5.1은 단백질 결합체 설계, Venus 고해상도 고도 지도 작성, GPU 커널 최적화를 수행했으며 단백질 설계에서 12개 표적 기준 거의 50%의 적중률과 일부 모델에서 최대 2.5배의 속도 향상을 기록했습니다. 동시에 생물학·사이버보안 접근을 검증된 사용자로 제한하고, 데이터 보존·프롬프트 인젝션·보상 해킹·증류 공격을 겨냥한 보호장치를 강화했습니다.

실용적 조언

  • 긴 문맥과 도구 호출이 반복되는 API 작업에서는 캐시 읽기 비중을 확인하는 것이 비용 예측에 중요합니다.
  • 생명과학 연구에 Claude Mythos 5.1을 사용하려면 Life Sciences Verification Program의 접근 절차와 제한 범위를 먼저 확인해야 합니다.
  • 방어적 사이버보안 작업에서도 취약점 식별과 익스플로잇 생성의 허용 범위가 다르므로 보호장치가 작업을 다른 모델로 전환할 수 있음을 고려해야 합니다.

섹션별 상세

01
Anthropic은 Claude Fable 5.1을 일반 공개하고 Claude Mythos 5.1을 신뢰 접근 프로그램으로 제한했습니다. 두 모델은 같은 기반 모델이지만 Mythos 5.1에는 사이버보안과 생명과학 연구를 위한 더 완화된 보호장치가 적용됩니다. Fable 5.1은 일반 작업에서 Fable 5보다 비용이 약 25% 낮고, 문맥과 도구 호출이 많은 에이전트 작업에서는 절감 폭이 최대 약 45%에 이르도록 캐시 읽기 가격을 백만 토큰당 $0.25로 조정했습니다.
02
Fable 5.1의 성능 평가는 코딩, 과학 연구, 지식 작업, 컴퓨터 사용, 다학제 추론, 업무 자동화로 나뉘어 진행됐습니다. 게시물의 비교표에서 Fable 5.1은 Terminal-Bench-Science 0.1에서 24.7%, Terminal-Bench 4.0에서 55.8%를 기록했고, CursorBench 3.2.0에서는 최대 노력 설정으로 73.4%를 얻었습니다. 다만 생산 보호장치가 개입한 작업은 일부 벤치마크에서 0점 처리됐고, OSWorld 2.0 수치는 2026년 8월의 새 과제 릴리스로 재실행돼 이전 공개 결과와 직접 비교할 수 없다는 조건이 붙었습니다.
03
게시물은 Fable 5.1이 단순한 코드 생성보다 원인 추적과 장시간 작업에 강하다고 설명합니다. Millennium의 내부 시스템에서 수년간 원인을 찾지 못한 백만 번 중 한 번꼴의 충돌을 외부 공급업체 라이브러리의 디스어셈블리와 코어 덤프 대조로 추적했고, Ramp에서는 38시간 동안 한 머신러닝 문제를 실행하며 라벨 아티팩트를 찾아 수정한 뒤 6개 병렬 실험을 수행했습니다. 이런 사례는 모델이 입력을 받아 답변만 내놓는 대신 기록을 유지하고, 실험을 병렬화하며, 검증 결과를 바탕으로 다음 작업을 선택하는 흐름을 갖췄다는 근거로 사용됐습니다.
04
Claude Mythos 5.1의 과학 연구 실험은 단백질 설계, Venus 지형 모델링, 계산생물학 최적화로 구성됐습니다. 단백질 설계에서는 공개 설계·접힘 도구로 후보를 생성해 외부 기관에서 실험 검증을 받았고, EGFR·Nipah G·15-PGDH를 포함한 3개 표적에서 Adaptyv Bio 대회 최고 설계보다 결합력이 10배 높았으며 12개 표적 전체의 적중률은 거의 50%였습니다. 또 Magellan 레이더 자료와 기존 Venus 지도 일부를 이용해 행성 3분의 1의 고도 지도를 만들고, 세부 해상도를 10~20km에서 2~3km로 높이며 높이 정확도를 최대 25% 개선했다고 게시물은 밝힙니다.
05
계산생물학에서는 Mythos 5.1이 맞춤형 GPU 커널과 중간 결과 캐싱을 적용해 7개 공개 단백질·유전체 모델의 출력을 바꾸지 않고 NVIDIA H100 추론을 최대 2.5배 빠르게 만들었습니다. Enformer, Flashzoi, Evo 2 등을 대규모 유전체 분석에 반복 실행할 때 최적화 효과가 누적돼 예상 GPU 비용이 30~60% 줄어들며, 이 작업을 공개 소스 코드만으로 며칠 안에 수행했다고 합니다. 안전 측면에서는 생물학 연구 기능을 검증된 전문가에게만 제공하고, 사이버보안에서는 취약점 식별은 허용하되 침투 테스트·익스플로잇 생성·바이너리 기반 취약점 스캔은 Opus 모델로 전환하도록 보호장치를 구성했습니다.

이미지 분석

NASA Magellan의 레이더 자료로 촬영한 Venus 표면의 방패 화산 이미지입니다.
Screenshot

이미지는 중앙의 밝은 화산 지형과 주변으로 뻗은 용암 흐름을 흑백 레이더 영상으로 나타내며, 하단에 10km 축척이 있습니다. 게시물은 이 자료를 Claude Fable 5.1이 고해상도 Venus 고도 지도를 만드는 입력으로 사용했다고 설명합니다. 기존 자료보다 작은 지질 구조를 식별하려는 연구 흐름과 직접 연결됩니다.

NASA Magellan의 레이더 자료로 촬영한 Venus 표면의 방패 화산 이미지입니다.

Venus 고도 측량 자료의 10~20km 규모 공간 발자국을 색상으로 표현한 이미지입니다.
Chart

이미지는 넓고 흐릿한 색상 영역으로 기존 고도 측량 자료의 낮은 공간 해상도를 시각화합니다. 게시물은 Claude가 이 자료와 Magellan 레이더 이미지, 기존 지도 일부를 결합해 2~3km 수준의 세부 정보를 갖는 새 고도 지도를 만들었다고 설명합니다. 따라서 이 이미지는 기존 입력 자료의 한계를 보여주는 비교 기준으로 기능합니다.

Venus 고도 측량 자료의 10~20km 규모 공간 발자국을 색상으로 표현한 이미지입니다.

약 15km 폭의 Venus 화산을 300m급 새 디지털 고도 모델로 표현한 이미지입니다.
Diagram

이미지는 중앙의 작은 방패 화산을 주변 지형보다 높은 색상으로 강조한 고도 모델입니다. 기사 본문은 새 지도가 기존 10~20km 수준보다 훨씬 세밀한 2~3km 지형 정보를 드러내며, 향후 NASA VERITAS와 ESA EnVision의 관측 대상 선정에 활용될 수 있다고 설명합니다. 이미지의 고해상도 화산 표현은 모델이 위성 자료를 과학적 지형 모델로 변환한 결과를 시각적으로 뒷받침합니다.

약 15km 폭의 Venus 화산을 300m급 새 디지털 고도 모델로 표현한 이미지입니다.

용어 해설

에이전트형 작업(Agentic Work)
모델이 단순히 한 번 답변하는 데 그치지 않고 도구를 호출하고, 여러 단계를 계획하며, 장시간 작업을 이어가는 방식입니다. Claude Fable 5.1은 이런 작업에서 캐시된 입력을 재사용해 토큰 비용을 낮추고, Claude Mythos 5.1은 연구·사이버보안 분야에서 더 완화된 보호장치를 적용합니다.
캐시 읽기(Cache Read)
이전에 처리해 저장한 입력을 다시 계산하지 않고 재사용하는 처리 방식입니다. Fable 5.1은 캐시 읽기 가격을 75% 낮춰 백만 토큰당 $0.25로 책정했고, 긴 문맥과 도구 호출이 반복되는 작업에서 전체 비용을 최대 약 45% 줄이는 구조를 취합니다.
단백질 설계(Protein Design)
특정 생물학적 표적에 강하게 결합하는 단백질을 계산적으로 설계하는 작업입니다. Claude Mythos 5.1은 공개 단백질 설계·접힘 도구를 사용해 후보를 만들고 외부 기관의 실험 검증을 거쳤으며, 12개 표적에서 거의 50%의 결합 후보 적중률을 기록했습니다.
맞춤형 GPU 커널(Custom GPU Kernel)
GPU에서 특정 연산을 더 효율적으로 실행하도록 작성한 전용 계산 코드입니다. Mythos 5.1은 맞춤형 GPU 커널과 중간 결과 캐싱을 조합해 공개 단백질·유전체 모델 7개의 추론을 최대 2.5배 빠르게 만들었고, 일부 전장 유전체 분석의 예상 GPU 비용을 30~60% 낮췄습니다.
프롬프트 인젝션(Prompt Injection)
AI가 처리하는 문서나 웹 콘텐츠 안에 숨겨진 적대적 지시를 통해 원래의 작업 규칙을 바꾸려는 공격입니다. Claude Mythos 5.1은 악성 요청과 프롬프트 인젝션 대응 평가를 받았으며, 외부 프롬프트 인젝션 벤치마크에서 Anthropic이 출시한 모델 중 가장 견고한 결과를 냈다고 게시물은 설명합니다.

언급된 도구

Claude Code추천

에이전트형 터미널 코딩과 장시간 소프트웨어 작업에 사용됩니다.

Claude Cowork추천

중간 노력 설정을 포함한 지식 작업과 협업형 업무에 사용됩니다.

Amazon Bedrock중립

Claude Fable 5.1과 관련 기능을 제공하는 클라우드 플랫폼입니다.

NVIDIA H100중립

단백질·유전체 모델의 최적화 전후 추론 속도와 비용을 측정하는 GPU입니다.

ESMFold2중립

Claude가 설계한 단백질 결합체 구조를 예측하는 데 사용됩니다.

Claude Security추천

코드베이스의 취약점을 찾아 인간 검토용 패치를 제안하는 제품입니다.

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 09. 02.수집 2026. 09. 02.출처 타입 REDDIT

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.