Claude Fable 5.1란: 2026 Mythos와 평가 해설
Anthropic은 같은 가중치를 공개 Fable 5.1과 게이트 Mythos 5.1로 나눴다. SKU를 먼저, 52.6%와 AA 66은 나중에.
Anthropic은 2026년 9월 1일 공개 Fable과 신뢰 접근 뒤의 Mythos 두 SKU를 냈다. 같은 기반이며 새 플래그십 가문이 아니다.
검색어는 Claude Fable 5.1과 Claude Mythos 5.1이다. 아래는 anthropic.com과 Artificial Analysis 9월 1일 평가다. 벤더 벤치는 독립 재현이 아니다.이전 안전 취향 메모: TASTE / Fable 5.
출시문에 적힌 것
Fable 5.1은 코딩, 지식 업무, 장시간 문제 해결용. Claude Code는 기본 High 노력, Cowork와 claude.ai는 Medium. 정가는 백만 토큰당 10/50달러 그대로. 변화는 캐시 읽기 0.25달러. 공식 추정은 8월 4주 실사용: 전형 부하에서 약 25% 저렴, 캐시가 지배하는 에이전트 부하에서 최대 약 45%. API 이름은 claude-fable-5-1.
세 행을 읽는 법
- 1
공개 SKU를 먼저, 게이트 SKU를 나중에
개발자는 API, claude.ai, Claude Code, 세 클라우드에서 Fable을 쓴다. Mythos는 심사며 같은 구독 키가 아니다. 공식은 Claude Security가 이제 Mythos 5.1로 코드베이스를 스캔하고 사람 검토용 패치를 낸다고 쓴다.
- 2
벤더 과학 벤치는 AA Terminal-Bench가 아니다
공식 Terminal-Bench-Science 0.1은 52.6%. 공개 리더보드(다른 하니스)는 Opus 5를 30.0%, Fable 5를 21.4%로 두고, 랩 자체는 29.0%와 24.7%로 둘 다 잡음 안이다. AA는 다른 Terminal-Bench v2.1에서 max 91.4%. 52.6%와 91.4%를 하나로 합치지 말라. 동점대: Muse Spark 1.3.
- 3
싼 캐시는 싼 작업 청구가 아니다
AA: max와 기본 폴백으로 66. Opus 5는 63, Fable 5는 62, GPT-5.6 Sol은 61. 폴백은 출력 토큰의 약 4%를 Opus 4.8 또는 Opus 5로 보낸다. 지수 작업당 약 3.76달러로 Fable 5의 3.14달러보다 약 20% 비싸다. 출력 토큰이 약 1.7배여서다. 캐시 인하는 약 1.40달러 절약. 없으면 약 5.16달러. xhigh는 65, 약 2.72달러.
과학 에이전트와 지식 업무
공식 GDPval-AA v2는 1853, Opus 5는 1824. AA도 1,853 Elo이며 Opus와 신뢰구간이 겹친다고 쓴다. AutomationBench 31.4%, CursorBench 3.2.0은 73.4%. HLE는 공식이 도구 없이 60.9%, 있으면 65.0%. AA 자체 HLE는 59.1%. 스위트 이름을 적어라.
랩 과학 사례는 벤더 서사다
Mythos는 오픈 단백질 설계 도구를 썼고 두 기관이 검증했다: 12개 표적 적중률 거의 50%, Adaptyv 3개 표적은 대회 최고 친화도의 약 10배. Fable은 마젤란 레이더로 금성 약 3분의 1의 더 고해상 고도 지도를 만들었다. Mythos는 공개 생물 모델 7개에 GPU 커널을 썼고 공식은 최대 약 2.5배. 공개 재현 팩이 아니다.
정밀한 문은 공개 펜테스트 API가 아니다
공식은 사이버 오탐 차단이 약 60% 줄었다고 쓴다. Fable은 취약점 발견에 쓸 수 있지만 익스플로잇, 펜테스트, 바이너리 스캔은 여전히 Opus로 간다. Enterprise Frontier Safeguards는 모니터링 데이터를 고객 클라우드에 두고 올가을 단계 도입. 그전까지 대상 고객은 Fable 5.1을 제로 보존으로 쓸 수 있다. 8월 2일 이후 모델은 EU 실무의 비가시 워터마크를 싣는다.
| 표현 | 대조 출처 | 읽는 법 |
|---|---|---|
| Science 52.6%; TB 4.0 55.8% / 60.9% | anthropic.com 2026-09-01 | 벤더 자체, 과학 벤치 SE 약 ±3.5–4.5 |
| AA 지수 max 66; 작업 ~3.76달러 | Artificial Analysis 2026-09-01 | 제3자 지수, 기본 폴백 ~4% 토큰 |
| 캐시 읽기 0.25달러; 정가 10 / 50 | Anthropic 가격표 | 읽기는 싸고 출력은 비싸다. 작업 청구는 별도 |
Anthropic: Claude Fable 5.1과 Claude Mythos 5.1은 같은 모델이며 안전장치 수준만 다르다.
# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1 # generally available
sku: claude-mythos-5-1 # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M # was $1.00
tb_science_0.1: 52.6% # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos # vendor
aa_index_max: 66 # default fallback ~4%
aa_task_cost_max: $3.76읽는 법과 경계
- 자체 표 ≠ 제3자 지수
- Science 52.6%와 HLE 65.0%는 랩 지명. AA 66과 AA HLE 59.1%는 다른 하니스. 하나로 합치지 말라.
- Mythos SKU ≠ 누구나 살 수 있는 키
- 신뢰 접근은 심사된 방어와 생명과학용. 느슨한 문은 접근 조건이며 오픈 체크포인트가 아니다.
- 회의 제품 설명이 아니다
- 출시와 평가만. 짧은 보드가 필요하면 wbmeet와 방 만들기.
확인하고 싶은 질문
Fable 5.1과 Mythos 5.1은 같은 가중치인가?
공식은 「같은 모델, 다른 안전 수준」이라고 쓴다. 공개 문서에 가중치 해시나 다운로드 체크포인트는 없다. 두 SKU, 두 접근 정책으로 다뤄라.
52.6%와 66 중 무엇이 공식인가?
둘 다 규제 결론이 아니다. 52.6%는 Anthropic Terminal-Bench-Science. 66은 AA의 max와 기본 폴백. 실험 메모에 스위트와 노력 행을 적어라.
Pro / Team에서 Mythos를 고를 수 있나?
없다. Mythos는 심사 프로그램이며 현재 미국 기관에 한정된다. CVP Mythos급은 「가까운 시일」이라고만 쓰여 있고 전면 개방일은 없다.
Anthropic이 다른 랩을 앞섰다는 증명인가?
왕관으로 쓸 수 없다. AA는 66을 자체 측정 최고라고 하지만 GDPval은 Opus와 구간이 겹치고 과학 벤치에는 표준오차가 있다. 이 페이지는 릴리스 구조만 푼다.