Claude Fable 5.1 2026: Mythos, Cache-Preis und die Evals
Ein Gewicht, zwei Tore: öffentliches Fable 5.1 und gegatetes Mythos 5.1. SKU zuerst, dann 52,6 % und AA 66.
Anthropic hat am 1. September 2026 zwei Claude-5.1-SKUs ausgeliefert: ein öffentliches Fable und Mythos hinter Trusted Access. Dieselbe Grundlage, keine neue Flaggschiff-Familie.
Die Suche ist Claude Fable 5.1 und Claude Mythos 5.1. Es folgt der anthropic.com-Post und die AA-Notiz vom 1. September. Vendor-Benches sind keine unabhängigen Replikationen. Vorheriger Safety-Taste: TASTE / Fable 5.
Was der Launch-Post druckt
Fable 5.1 zielt auf Coding, Knowledge Work und lange Problemlösung. Claude Code defaultet auf High Effort, Cowork und claude.ai auf Medium. Listenpreis bleibt 10 / 50 $ pro Million Tokens. Die Änderung sind Cache-Reads zu 0,25 $. Die Schätzung nutzt vier August-Wochen: etwa 25 % günstiger bei typischer Last, bis etwa 45 %, wenn Cache dominiert. API-Name: claude-fable-5-1.
Die drei Zeilen lesen
- 1
Öffentliches SKU zuerst, gegatetes danach
Entwickler holen Fable über API, claude.ai, Claude Code und die drei Clouds. Mythos braucht ein Verifikationsprogramm — nicht denselben Abo-Key. Anthropic schreibt außerdem, Claude Security laufe jetzt auf Mythos 5.1 und schlage Patches zur menschlichen Prüfung vor.
- 2
Die Vendor-Science-Bank ist nicht AAs Terminal-Bench
Offiziell Terminal-Bench-Science 0.1: 52,6 %. Die öffentliche Bestenliste (anderer Harness) nennt Opus 5 30,0 % und Fable 5 21,4 %; das Labor reproduziert 29,0 % und 24,7 %, beides im Rauschen. AA misst Terminal-Bench v2.1 mit 91,4 % max. 52,6 % und 91,4 % nicht zu einer Krone pressen. Gleichstand: Muse Spark 1.3.
- 3
Billigerer Cache ist nicht dieselbe Task-Rechnung
AA: 66 bei max mit Default-Fallback, vor Opus 5 (63), Fable 5 (62), GPT-5.6 Sol (61). Fallback lieferte etwa 4 % der Output-Tokens über Opus 4.8 oder Opus 5. Kosten etwa 3,76 $ pro Index-Task gegen 3,14 $ bei Fable 5 — rund 20 % mehr — weil Output-Tokens etwa 1,7× sind. Der Cache-Schnitt spart etwa 1,40 $; ohne ihn etwa 5,16 $. xhigh erreicht 65 bei etwa 2,72 $.
Science-Agenten und Knowledge Work
Anthropic schreibt GDPval-AA v2 1853 gegen 1824 bei Opus 5. AA wiederholt 1.853 Elo und überlappende Konfidenzintervalle mit Opus. AutomationBench 31,4 %; CursorBench 3.2.0 73,4 %. Vendor-HLE 60,9 % ohne Tools, 65,0 % mit Tools; AAs eigenes HLE 59,1 %. Suite nennen.
Labor-Science-Fälle bleiben Vendor-Erzählung
Mythos nutzte Open-Source-Protein-Tools; zwei externe Orgs validierten: fast 50 % Hit-Rate über 12 Targets, etwa 10× die besten Adaptyv-Affinitäten auf drei Targets. Fable baute aus Magellan-Radar eine höher aufgelöste Höhenkarte für etwa ein Drittel der Venus. Mythos schrieb GPU-Kernel für sieben offene Bio-Modelle; offiziell bis etwa 2,5×. Kein öffentliches Repro-Paket.
Schärfere Tore sind keine öffentliche Pentest-API
Anthropic schreibt etwa 60 % weniger Cyber-False-Positive-Blocks. Fable darf Schwachstellen finden; Exploits, Pentests und Binärscans gehen weiter an Opus. Enterprise Frontier Safeguards legen Monitoring-Daten in die Kunden-Cloud, stufenweise im Herbst; berechtigte Kunden können Fable 5.1 bis dahin mit Zero Retention nutzen. Modelle nach dem 2. August tragen ein unsichtbares EU-Wasserzeichen.
| Aussage | Prüfbare Quelle | Lesart |
|---|---|---|
| Science 52,6 %; TB 4.0 55,8 % / 60,9 % | anthropic.com 2026-09-01 | Vendor-Lauf; Science-SE etwa ±3,5–4,5 |
| AA max 66; ~3,76 $ / Task | Artificial Analysis 2026-09-01 | Drittindex; Default-Fallback ~4 % Tokens |
| Cache-Read 0,25 $; Liste 10 / 50 | Anthropic-Preiskarte | Reads günstiger, Output teuer; Taskrechnung extra |
Anthropic: Claude Fable 5.1 und Claude Mythos 5.1 sind dasselbe Modell, aber mit unterschiedlichen Safeguard-Stufen.
# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1 # generally available
sku: claude-mythos-5-1 # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M # was $1.00
tb_science_0.1: 52.6% # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos # vendor
aa_index_max: 66 # default fallback ~4%
aa_task_cost_max: $3.76Grenzen
- Vendor-Tabellen ≠ Drittindex
- Science 52,6 % und HLE 65,0 % sind laborbenannt. AA 66 und AAs HLE 59,1 % sind ein anderer Harness. Nicht zu einer Krone zusammendrücken.
- Das Mythos-SKU ≠ ein Key für alle
- Trusted Access ist für geprüfte Verteidiger und Life Scientists. Die lockereren Tore sind die Zugangsbedingung, kein offener Checkpoint.
- Keine Meeting-Produktseite
- Nur Release und Eval. Für ein kurzes Board: wbmeet und Raum erstellen.
Fragen zum Gegenprüfen
Sind Fable 5.1 und Mythos 5.1 dieselben Gewichte?
Anthropic schreibt „dasselbe Modell“ mit anderen Safeguard-Stufen. Öffentliche Docs nennen keinen Gewichtshash und keinen Download-Checkpoint. Zwei SKUs, zwei Zugangsregeln.
Ist 52,6 % oder 66 „offiziell“?
Keines ist ein Regulierungsbefund. 52,6 % ist Anthropics Terminal-Bench-Science. 66 ist AA bei max mit Default-Fallback. Suite und Effort-Zeile in jede Labornotiz.
Kann ein Pro- oder Team-Plan Mythos wählen?
Nein. Mythos läuft über Verifikationsprogramme und ist derzeit auf US-Organisationen begrenzt. CVP-Mythos-Klasse steht als „nahe Zukunft“, ohne Vollöffnungstermin.
Beweis, dass Anthropic andere Labs überholt hat?
Nicht als Krone. AA nennt 66 den höchsten selbst gemessenen Wert, aber GDPval-Intervalle überlappen Opus, und die Science-Bank hat einen Standardfehler. Diese Seite zerlegt nur das Release.