Claude Fable 5.1 2026: Mythos, Cache-Preis und die Evals

Ein Gewicht, zwei Tore: öffentliches Fable 5.1 und gegatetes Mythos 5.1. SKU zuerst, dann 52,6 % und AA 66.

Anthropic hat am 1. September 2026 zwei Claude-5.1-SKUs ausgeliefert: ein öffentliches Fable und Mythos hinter Trusted Access. Dieselbe Grundlage, keine neue Flaggschiff-Familie.

Die Suche ist Claude Fable 5.1 und Claude Mythos 5.1. Es folgt der anthropic.com-Post und die AA-Notiz vom 1. September. Vendor-Benches sind keine unabhängigen Replikationen. Vorheriger Safety-Taste: TASTE / Fable 5.

Fable 51. Sep.: Fable 5.1Trusted Access: Mythos 5.1

Was der Launch-Post druckt

Fable 5.1 zielt auf Coding, Knowledge Work und lange Problemlösung. Claude Code defaultet auf High Effort, Cowork und claude.ai auf Medium. Listenpreis bleibt 10 / 50 $ pro Million Tokens. Die Änderung sind Cache-Reads zu 0,25 $. Die Schätzung nutzt vier August-Wochen: etwa 25 % günstiger bei typischer Last, bis etwa 45 %, wenn Cache dominiert. API-Name: claude-fable-5-1.

52.6%
Terminal-Bench-Science (Vendor-Lauf)
66
AA-Index max (Default-Fallback)
$0.25
Cache-Read / Million Tokens

Die drei Zeilen lesen

  1. 1

    Öffentliches SKU zuerst, gegatetes danach

    Entwickler holen Fable über API, claude.ai, Claude Code und die drei Clouds. Mythos braucht ein Verifikationsprogramm — nicht denselben Abo-Key. Anthropic schreibt außerdem, Claude Security laufe jetzt auf Mythos 5.1 und schlage Patches zur menschlichen Prüfung vor.

  2. 2

    Die Vendor-Science-Bank ist nicht AAs Terminal-Bench

    Offiziell Terminal-Bench-Science 0.1: 52,6 %. Die öffentliche Bestenliste (anderer Harness) nennt Opus 5 30,0 % und Fable 5 21,4 %; das Labor reproduziert 29,0 % und 24,7 %, beides im Rauschen. AA misst Terminal-Bench v2.1 mit 91,4 % max. 52,6 % und 91,4 % nicht zu einer Krone pressen. Gleichstand: Muse Spark 1.3.

  3. 3

    Billigerer Cache ist nicht dieselbe Task-Rechnung

    AA: 66 bei max mit Default-Fallback, vor Opus 5 (63), Fable 5 (62), GPT-5.6 Sol (61). Fallback lieferte etwa 4 % der Output-Tokens über Opus 4.8 oder Opus 5. Kosten etwa 3,76 $ pro Index-Task gegen 3,14 $ bei Fable 5 — rund 20 % mehr — weil Output-Tokens etwa 1,7× sind. Der Cache-Schnitt spart etwa 1,40 $; ohne ihn etwa 5,16 $. xhigh erreicht 65 bei etwa 2,72 $.

01

Science-Agenten und Knowledge Work

Anthropic schreibt GDPval-AA v2 1853 gegen 1824 bei Opus 5. AA wiederholt 1.853 Elo und überlappende Konfidenzintervalle mit Opus. AutomationBench 31,4 %; CursorBench 3.2.0 73,4 %. Vendor-HLE 60,9 % ohne Tools, 65,0 % mit Tools; AAs eigenes HLE 59,1 %. Suite nennen.

02

Labor-Science-Fälle bleiben Vendor-Erzählung

Mythos nutzte Open-Source-Protein-Tools; zwei externe Orgs validierten: fast 50 % Hit-Rate über 12 Targets, etwa 10× die besten Adaptyv-Affinitäten auf drei Targets. Fable baute aus Magellan-Radar eine höher aufgelöste Höhenkarte für etwa ein Drittel der Venus. Mythos schrieb GPU-Kernel für sieben offene Bio-Modelle; offiziell bis etwa 2,5×. Kein öffentliches Repro-Paket.

03

Schärfere Tore sind keine öffentliche Pentest-API

Anthropic schreibt etwa 60 % weniger Cyber-False-Positive-Blocks. Fable darf Schwachstellen finden; Exploits, Pentests und Binärscans gehen weiter an Opus. Enterprise Frontier Safeguards legen Monitoring-Daten in die Kunden-Cloud, stufenweise im Herbst; berechtigte Kunden können Fable 5.1 bis dahin mit Zero Retention nutzen. Modelle nach dem 2. August tragen ein unsichtbares EU-Wasserzeichen.

AussagePrüfbare QuelleLesart
Science 52,6 %; TB 4.0 55,8 % / 60,9 %anthropic.com 2026-09-01Vendor-Lauf; Science-SE etwa ±3,5–4,5
AA max 66; ~3,76 $ / TaskArtificial Analysis 2026-09-01Drittindex; Default-Fallback ~4 % Tokens
Cache-Read 0,25 $; Liste 10 / 50Anthropic-PreiskarteReads günstiger, Output teuer; Taskrechnung extra

Anthropic: Claude Fable 5.1 und Claude Mythos 5.1 sind dasselbe Modell, aber mit unterschiedlichen Safeguard-Stufen.

# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1          # generally available
sku: claude-mythos-5-1         # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M       # was $1.00
tb_science_0.1: 52.6%          # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos   # vendor
aa_index_max: 66               # default fallback ~4%
aa_task_cost_max: $3.76

Grenzen

Vendor-Tabellen ≠ Drittindex
Science 52,6 % und HLE 65,0 % sind laborbenannt. AA 66 und AAs HLE 59,1 % sind ein anderer Harness. Nicht zu einer Krone zusammendrücken.
Das Mythos-SKU ≠ ein Key für alle
Trusted Access ist für geprüfte Verteidiger und Life Scientists. Die lockereren Tore sind die Zugangsbedingung, kein offener Checkpoint.
Keine Meeting-Produktseite
Nur Release und Eval. Für ein kurzes Board: wbmeet und Raum erstellen.

Fragen zum Gegenprüfen

Sind Fable 5.1 und Mythos 5.1 dieselben Gewichte?

Anthropic schreibt „dasselbe Modell“ mit anderen Safeguard-Stufen. Öffentliche Docs nennen keinen Gewichtshash und keinen Download-Checkpoint. Zwei SKUs, zwei Zugangsregeln.

Ist 52,6 % oder 66 „offiziell“?

Keines ist ein Regulierungsbefund. 52,6 % ist Anthropics Terminal-Bench-Science. 66 ist AA bei max mit Default-Fallback. Suite und Effort-Zeile in jede Labornotiz.

Kann ein Pro- oder Team-Plan Mythos wählen?

Nein. Mythos läuft über Verifikationsprogramme und ist derzeit auf US-Organisationen begrenzt. CVP-Mythos-Klasse steht als „nahe Zukunft“, ohne Vollöffnungstermin.

Beweis, dass Anthropic andere Labs überholt hat?

Nicht als Krone. AA nennt 66 den höchsten selbst gemessenen Wert, aber GDPval-Intervalle überlappen Opus, und die Science-Bank hat einen Standardfehler. Diese Seite zerlegt nur das Release.

Kostenloses Meeting starten