Claude Fable 5.1란: 2026 Mythos와 평가 해설

Anthropic은 같은 가중치를 공개 Fable 5.1과 게이트 Mythos 5.1로 나눴다. SKU를 먼저, 52.6%와 AA 66은 나중에.

Anthropic은 2026년 9월 1일 공개 Fable과 신뢰 접근 뒤의 Mythos 두 SKU를 냈다. 같은 기반이며 새 플래그십 가문이 아니다.

검색어는 Claude Fable 5.1Claude Mythos 5.1이다. 아래는 anthropic.com과 Artificial Analysis 9월 1일 평가다. 벤더 벤치는 독립 재현이 아니다.이전 안전 취향 메모: TASTE / Fable 5.

Fable 59월 1일: Fable 5.1신뢰 접근: Mythos 5.1

출시문에 적힌 것

Fable 5.1은 코딩, 지식 업무, 장시간 문제 해결용. Claude Code는 기본 High 노력, Cowork와 claude.ai는 Medium. 정가는 백만 토큰당 10/50달러 그대로. 변화는 캐시 읽기 0.25달러. 공식 추정은 8월 4주 실사용: 전형 부하에서 약 25% 저렴, 캐시가 지배하는 에이전트 부하에서 최대 약 45%. API 이름은 claude-fable-5-1.

52.6%
Terminal-Bench-Science(벤더 자체)
66
AA 지수 max(기본 폴백)
$0.25
캐시 읽기 / 백만 토큰

세 행을 읽는 법

  1. 1

    공개 SKU를 먼저, 게이트 SKU를 나중에

    개발자는 API, claude.ai, Claude Code, 세 클라우드에서 Fable을 쓴다. Mythos는 심사며 같은 구독 키가 아니다. 공식은 Claude Security가 이제 Mythos 5.1로 코드베이스를 스캔하고 사람 검토용 패치를 낸다고 쓴다.

  2. 2

    벤더 과학 벤치는 AA Terminal-Bench가 아니다

    공식 Terminal-Bench-Science 0.1은 52.6%. 공개 리더보드(다른 하니스)는 Opus 5를 30.0%, Fable 5를 21.4%로 두고, 랩 자체는 29.0%와 24.7%로 둘 다 잡음 안이다. AA는 다른 Terminal-Bench v2.1에서 max 91.4%. 52.6%와 91.4%를 하나로 합치지 말라. 동점대: Muse Spark 1.3.

  3. 3

    싼 캐시는 싼 작업 청구가 아니다

    AA: max와 기본 폴백으로 66. Opus 5는 63, Fable 5는 62, GPT-5.6 Sol은 61. 폴백은 출력 토큰의 약 4%를 Opus 4.8 또는 Opus 5로 보낸다. 지수 작업당 약 3.76달러로 Fable 5의 3.14달러보다 약 20% 비싸다. 출력 토큰이 약 1.7배여서다. 캐시 인하는 약 1.40달러 절약. 없으면 약 5.16달러. xhigh는 65, 약 2.72달러.

01

과학 에이전트와 지식 업무

공식 GDPval-AA v2는 1853, Opus 5는 1824. AA도 1,853 Elo이며 Opus와 신뢰구간이 겹친다고 쓴다. AutomationBench 31.4%, CursorBench 3.2.0은 73.4%. HLE는 공식이 도구 없이 60.9%, 있으면 65.0%. AA 자체 HLE는 59.1%. 스위트 이름을 적어라.

02

랩 과학 사례는 벤더 서사다

Mythos는 오픈 단백질 설계 도구를 썼고 두 기관이 검증했다: 12개 표적 적중률 거의 50%, Adaptyv 3개 표적은 대회 최고 친화도의 약 10배. Fable은 마젤란 레이더로 금성 약 3분의 1의 더 고해상 고도 지도를 만들었다. Mythos는 공개 생물 모델 7개에 GPU 커널을 썼고 공식은 최대 약 2.5배. 공개 재현 팩이 아니다.

03

정밀한 문은 공개 펜테스트 API가 아니다

공식은 사이버 오탐 차단이 약 60% 줄었다고 쓴다. Fable은 취약점 발견에 쓸 수 있지만 익스플로잇, 펜테스트, 바이너리 스캔은 여전히 Opus로 간다. Enterprise Frontier Safeguards는 모니터링 데이터를 고객 클라우드에 두고 올가을 단계 도입. 그전까지 대상 고객은 Fable 5.1을 제로 보존으로 쓸 수 있다. 8월 2일 이후 모델은 EU 실무의 비가시 워터마크를 싣는다.

표현대조 출처읽는 법
Science 52.6%; TB 4.0 55.8% / 60.9%anthropic.com 2026-09-01벤더 자체, 과학 벤치 SE 약 ±3.5–4.5
AA 지수 max 66; 작업 ~3.76달러Artificial Analysis 2026-09-01제3자 지수, 기본 폴백 ~4% 토큰
캐시 읽기 0.25달러; 정가 10 / 50Anthropic 가격표읽기는 싸고 출력은 비싸다. 작업 청구는 별도

Anthropic: Claude Fable 5.1과 Claude Mythos 5.1은 같은 모델이며 안전장치 수준만 다르다.

# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1          # generally available
sku: claude-mythos-5-1         # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M       # was $1.00
tb_science_0.1: 52.6%          # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos   # vendor
aa_index_max: 66               # default fallback ~4%
aa_task_cost_max: $3.76

읽는 법과 경계

자체 표 ≠ 제3자 지수
Science 52.6%와 HLE 65.0%는 랩 지명. AA 66과 AA HLE 59.1%는 다른 하니스. 하나로 합치지 말라.
Mythos SKU ≠ 누구나 살 수 있는 키
신뢰 접근은 심사된 방어와 생명과학용. 느슨한 문은 접근 조건이며 오픈 체크포인트가 아니다.
회의 제품 설명이 아니다
출시와 평가만. 짧은 보드가 필요하면 wbmeet방 만들기.

확인하고 싶은 질문

Fable 5.1과 Mythos 5.1은 같은 가중치인가?

공식은 「같은 모델, 다른 안전 수준」이라고 쓴다. 공개 문서에 가중치 해시나 다운로드 체크포인트는 없다. 두 SKU, 두 접근 정책으로 다뤄라.

52.6%와 66 중 무엇이 공식인가?

둘 다 규제 결론이 아니다. 52.6%는 Anthropic Terminal-Bench-Science. 66은 AA의 max와 기본 폴백. 실험 메모에 스위트와 노력 행을 적어라.

Pro / Team에서 Mythos를 고를 수 있나?

없다. Mythos는 심사 프로그램이며 현재 미국 기관에 한정된다. CVP Mythos급은 「가까운 시일」이라고만 쓰여 있고 전면 개방일은 없다.

Anthropic이 다른 랩을 앞섰다는 증명인가?

왕관으로 쓸 수 없다. AA는 66을 자체 측정 최고라고 하지만 GDPval은 Opus와 구간이 겹치고 과학 벤치에는 표준오차가 있다. 이 페이지는 릴리스 구조만 푼다.

무료로 회의 시작