Claude Fable 5.1 2026 : Mythos, prix du cache et évals

Un poids, deux portes : Fable 5.1 public et Mythos 5.1 gated. Nommer le SKU avant le 52,6 % ou l’AA 66.

Anthropic a livré deux SKU Claude 5.1 le 1er septembre 2026 : un Fable public, et Mythos derrière l’accès de confiance. Même modèle sous-jacent, pas une nouvelle famille phare.

La requête est Claude Fable 5.1 et Claude Mythos 5.1. Suit le billet anthropic.com et la note Artificial Analysis du 1er septembre. Les bancs vendor ne sont pas des reproductions indépendantes. Note goût/sécurité précédente : TASTE / Fable 5.

Fable 51er sept. : Fable 5.1Accès de confiance : Mythos 5.1

Ce que le billet de lancement imprime

Fable 5.1 vise le code, le travail de connaissance et la résolution longue. Claude Code est en High par défaut ; Cowork et claude.ai en Medium. Tarif liste inchangé : 10 / 50 $ par million de tokens. Le changement, ce sont les lectures cache à 0,25 $. L’estimation repose sur quatre semaines d’août : environ 25 % moins cher en charge typique, jusqu’à environ 45 % quand le cache domine. Nom d’API : claude-fable-5-1.

52.6%
Terminal-Bench-Science (run vendor)
66
Indice AA max (repli par défaut)
$0.25
Lecture cache / million de tokens

Lire les trois lignes

  1. 1

    Nommer le SKU public avant le SKU gated

    Les développeurs ont Fable sur l’API, claude.ai, Claude Code et les trois clouds. Mythos exige un programme de vérification — pas la même clé d’abonnement. Anthropic écrit aussi que Claude Security tourne maintenant sur Mythos 5.1 et propose des correctifs à revoir par un humain.

  2. 2

    Le banc science vendor n’est pas le Terminal-Bench d’AA

    Officiel : Terminal-Bench-Science 0.1 à 52,6 %. Le classement public (autre harness) met Opus 5 à 30,0 % et Fable 5 à 21,4 % ; le labo reproduit 29,0 % et 24,7 %, les deux dans le bruit. AA mesure Terminal-Bench v2.1 à 91,4 % max. Ne pas fondre 52,6 % et 91,4 % en une couronne. Bande d’égalité : Muse Spark 1.3.

  3. 3

    Un cache moins cher n’est pas une facture de tâche moins chère

    AA : 66 au max avec repli par défaut, devant Opus 5 à 63, Fable 5 à 62 et GPT-5.6 Sol à 61. Le repli a servi environ 4 % des tokens de sortie via Opus 4.8 ou Opus 5. Coût d’environ 3,76 $ par tâche d’indice contre 3,14 $ pour Fable 5 — environ 20 % de plus — parce que les tokens de sortie sont environ 1,7×. La baisse du cache économise environ 1,40 $ ; sans elle, environ 5,16 $. xhigh marque 65 à environ 2,72 $.

01

Agents scientifiques et travail de connaissance

Anthropic écrit GDPval-AA v2 à 1853 contre 1824 pour Opus 5. AA répète 1 853 Elo et des intervalles de confiance qui se chevauchent avec Opus. AutomationBench 31,4 % ; CursorBench 3.2.0 73,4 %. HLE vendor : 60,9 % sans outils, 65,0 % avec outils ; le HLE d’AA est 59,1 %. Nommer la suite.

02

Les cas science du labo restent un récit vendor

Mythos a utilisé des outils protéines open source ; deux orgs externes ont validé : près de 50 % de hits sur 12 cibles, environ 10× les meilleures affinités Adaptyv sur trois cibles. Fable a produit une carte d’altitude plus fine pour environ un tiers de Vénus à partir du radar Magellan. Mythos a écrit des kernels GPU pour sept modèles bio ouverts ; Anthropic écrit jusqu’à environ 2,5×. Pas un pack de repro public.

03

Des portes plus précises ne sont pas une API de pentest publique

Anthropic écrit environ 60 % de blocages cyber faux positifs en moins. Fable peut désormais trouver des vulnérabilités ; génération d’exploits, pentest et scan binaire restent routés vers Opus. Enterprise Frontier Safeguards place les données de surveillance dans le cloud du client, par phases cet automne ; les clients éligibles peuvent utiliser Fable 5.1 en rétention zéro d’ici là. Les modèles après le 2 août portent un filigrane invisible selon la pratique UE.

FormulationSource vérifiableLecture
Science 52,6 % ; TB 4.0 55,8 % / 60,9 %anthropic.com 2026-09-01Run vendor ; SE science environ ±3,5–4,5
AA max 66 ; ~3,76 $ / tâcheArtificial Analysis 2026-09-01Indice tiers ; repli par défaut ~4 % tokens
Lecture cache 0,25 $ ; liste 10 / 50Grille AnthropicLectures moins chères, sortie chère ; facture tâche à part

Anthropic : Claude Fable 5.1 et Claude Mythos 5.1 sont le même modèle, mais avec des niveaux de garde-fous différents.

# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1          # generally available
sku: claude-mythos-5-1         # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M       # was $1.00
tb_science_0.1: 52.6%          # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos   # vendor
aa_index_max: 66               # default fallback ~4%
aa_task_cost_max: $3.76

Limites

Tables vendor ≠ indice tiers
Science 52,6 % et HLE 65,0 % sont nommés par le labo. AA 66 et le HLE d’AA à 59,1 % sont un autre harness. Ne pas les fondre en une couronne.
Le SKU Mythos ≠ une clé pour tous
L’accès de confiance vise des défenseurs et des chercheurs examinés. Les portes plus souples sont la condition d’accès, pas un checkpoint ouvert.
Cette page n’est pas une fiche réunion
Sortie et éval seulement. Pour un huddle court : wbmeet et créer une salle.

Questions à recouper

Fable 5.1 et Mythos 5.1 ont-ils les mêmes poids ?

Anthropic écrit « le même modèle » avec d’autres niveaux de garde-fous. Les docs publics ne donnent ni hash de poids ni checkpoint téléchargeable. Traiter deux SKU, deux politiques d’accès.

52,6 % ou 66 est-il le score « officiel » ?

Ni l’un ni l’autre n’est un constat de régulateur. 52,6 % est le Terminal-Bench-Science d’Anthropic. 66 est l’AA au max avec repli par défaut. Nommer la suite et la ligne d’effort sur toute note de labo.

Un forfait Pro ou Team peut-il choisir Mythos ?

Non. Mythos passe par des programmes de vérification et reste limité aux orgs américaines. L’accès CVP classe Mythos est écrit « avenir proche », sans date d’ouverture large.

Preuve qu’Anthropic a dépassé les autres labs ?

Pas une couronne à elle seule. AA appelle 66 le plus haut qu’elle a mesuré, mais les intervalles GDPval chevauchent Opus, et le banc science a une erreur type. Cette page ne déplie que la sortie.

Démarrer une réunion gratuite