Claude Fable 5.1是什么:2026年Mythos与评测全解析
Anthropic 把同一权重拆成公开的 Fable 5.1 与门控的 Mythos 5.1。先分 SKU,再读科学榜与 AA 66。
Anthropic 在 2026 年 9 月 1 日放出两款 Claude 5.1:公开的 Fable,以及只走受信任通道的 Mythos。同一底层,不是另开一个旗舰家族。
检索词是 Claude Fable 5.1 与 Claude Mythos 5.1。下面按 anthropic.com 发布帖与 Artificial Analysis 9 月 1 日评测来写。厂商基准不是独立复现。上一档安全口味见本站 TASTE / Fable 5。
官方写成了什么
Fable 5.1 强调编码、知识工作与长程解题。Claude Code 默认 High 努力档,Cowork 与 claude.ai 默认 Medium。列表价未动:每百万 token 10 / 50 美元;变动在缓存读,降到 0.25 美元。官方按 8 月四周实际用量估算:典型负载大约便宜 25%,缓存占比高的智能体负载最高约 45%。API 名是 claude-fable-5-1。
怎么读这三行数字
- 1
先认公开档,再谈门控档
开发者可在 API、claude.ai、Claude Code 与三家云上调 Fable。Mythos 要走核验,不是同一把订阅钥匙。官方还写 Claude Security 现由 Mythos 5.1 驱动,给企业扫代码库、提补丁供人审。
- 2
厂商科学榜不是 AA 的 Terminal-Bench
官方 Terminal-Bench-Science 0.1:Fable 5.1 为 52.6%,公开榜用另一套 harness 把 Opus 5 写成 30.0%、Fable 5 写成 21.4%,实验室自跑是 29.0% 与 24.7%,都在噪声内。AA 写的是另一套 Terminal-Bench v2.1,max 档 91.4%。不要把 52.6% 和 91.4% 揉成一个冠军。并列带见 Muse Spark 1.3。
- 3
缓存降价不等于任务账单更便宜
AA:max 加默认回退得 66,高于 Opus 5 的 63、Fable 5 的 62、GPT-5.6 Sol 的 61。回退把约 4% 输出 token 转到 Opus 4.8 或 Opus 5。每项指数任务约 3.76 美元,比 Fable 5 的 3.14 美元贵约 20%,因为输出 token 大约是 1.7 倍。缓存降价大约省 1.40 美元;若不降,任务约 5.16 美元。xhigh 得 65,任务约 2.72 美元。
科学智能体与知识工作
厂商写 GDPval-AA v2 为 1853,Opus 5 为 1824。AA 复测同一 1853 Elo,并写与 Opus 的置信区间重叠。AutomationBench 31.4%,CursorBench 3.2.0 为 73.4%。HLE 厂商写无工具 60.9%、有工具 65.0%;AA 自己的 HLE 是 59.1%。套件名字必须写上。
实验室科学案例仍是厂商叙事
Mythos 用开源蛋白设计工具,外送两家机构验证:12 个靶点命中率近 50%,三枚 Adaptyv 靶点亲和力约为竞赛最佳的 10 倍。Fable 用麦哲伦雷达做了约三分之一金星的更高分辨率高程图。Mythos 还为七个开源生物模型写 GPU 核,官方写最高约 2.5 倍。这些不是公开复现包。
闸门更准,不等于人人可做渗透
官方写网络防护误拦少约 60%,Fable 现可用于发现漏洞,但利用、渗透测试与二进制扫洞仍转到 Opus。Enterprise Frontier Safeguards 把监控数据放在客户云上,秋季分阶段;此前符合条件的客户可对 Fable 5.1 使用零留存。8 月 2 日后的模型按欧盟实践加不可见水印。
| 说法 | 能核对的来源 | 读法 |
|---|---|---|
| Science 52.6%;TB 4.0 为 55.8% / 60.9% | anthropic.com 2026-09-01 | 厂商自跑,科学榜标准误约 ±3.5–4.5 |
| AA 指数 max 66;任务约 3.76 美元 | Artificial Analysis 2026-09-01 | 第三方指数,默认回退约 4% token |
| 缓存读 0.25 美元;列表价 10 / 50 | Anthropic 价目 | 读更便宜,输出仍贵;任务账单另算 |
Anthropic:Claude Fable 5.1 与 Claude Mythos 5.1 是同一模型,只是闸门级别不同。
# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1 # generally available
sku: claude-mythos-5-1 # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M # was $1.00
tb_science_0.1: 52.6% # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos # vendor
aa_index_max: 66 # default fallback ~4%
aa_task_cost_max: $3.76读法与边界
- 自报榜 ≠ 第三方指数
- Science 52.6%、HLE 65.0% 是实验室点名。AA 66 与 AA 的 HLE 59.1% 是另一套 harness。不要揉成一个冠军。
- Mythos SKU ≠ 人人可订
- 受信任通道面向核过的防御与生命科学方。更松的闸门是访问条件,不是开源检查点。
- 新闻页不是会议说明书
- 只解释发布与评测。要约短会白板,用 wbmeet 建房,见 如何创建与加入房间。
还想核对的问题
Fable 5.1 和 Mythos 5.1 是不是同一个权重?
官方写「同一模型、不同闸门」。公开文档没有给出权重哈希或可下载检查点。采购时按两个 SKU、两套访问策略处理。
52.6% 和 66 哪个是「官方分」?
都不是监管结论。52.6% 是 Anthropic 自报的 Terminal-Bench-Science。66 是 AA 在 max 加默认回退下的指数。写实验记录时把套件与努力档写上。
Pro / Team 订阅能直接选 Mythos 吗?
不能。Mythos 走核验通道,现阶段以美国机构为主。CVP 的 Mythos 档官方写「不久后」,没有给出全面开放日。
这能证明 Anthropic 已超过其他实验室吗?
不能单独当皇冠。AA 写 66 是他们测过的最高分,但 GDPval 与 Opus 的区间重叠,科学榜带标准误。本页只拆发布结构。