Claude Fable 5.1是什麼:2026年Mythos與評測全解析

Anthropic 把同一權重拆成公開的 Fable 5.1 與門控的 Mythos 5.1。先分 SKU,再讀科學榜與 AA 66。

Anthropic 在 2026 年 9 月 1 日推出兩款 Claude 5.1:公開的 Fable,以及只走受信任通道的 Mythos。同一底層,不是另開一個旗艦家族。

檢索詞是 Claude Fable 5.1Claude Mythos 5.1。以下依 anthropic.com 發布文與 Artificial Analysis 9 月 1 日評測。廠商基準不是獨立重現。上一檔安全口味見本站 TASTE / Fable 5

Fable 59 月 1 日:Fable 5.1受信任通道:Mythos 5.1

官方寫成了什麼

Fable 5.1 強調編碼、知識工作與長程解題。Claude Code 預設 High 努力檔,Cowork 與 claude.ai 預設 Medium。列表價未動:每百萬 token 10 / 50 美元;變動在快取讀,降到 0.25 美元。官方按 8 月四週實際用量估算:典型負載大約便宜 25%,快取佔比高的智慧體負載最高約 45%。API 名是 claude-fable-5-1

52.6%
Terminal-Bench-Science(廠商自報)
66
AA 指數 max(預設回退)
$0.25
快取讀 / 百萬 token

怎麼讀這三行數字

  1. 1

    先認公開檔,再談門控檔

    開發者可在 API、claude.ai、Claude Code 與三家雲上調 Fable。Mythos 要走核驗,不是同一把訂閱鑰匙。官方還寫 Claude Security 現由 Mythos 5.1 驅動,給企業掃程式庫、提修補供人審。

  2. 2

    廠商科學榜不是 AA 的 Terminal-Bench

    官方 Terminal-Bench-Science 0.1:Fable 5.1 為 52.6%,公開榜用另一套 harness 把 Opus 5 寫成 30.0%、Fable 5 寫成 21.4%,實驗室自跑是 29.0% 與 24.7%,都在雜訊內。AA 寫的是另一套 Terminal-Bench v2.1,max 檔 91.4%。不要把 52.6% 和 91.4% 揉成一個冠軍。並列帶見 Muse Spark 1.3

  3. 3

    快取降價不等於任務帳單更便宜

    AA:max 加預設回退得 66,高於 Opus 5 的 63、Fable 5 的 62、GPT-5.6 Sol 的 61。回退把約 4% 輸出 token 轉到 Opus 4.8 或 Opus 5。每項指數任務約 3.76 美元,比 Fable 5 的 3.14 美元貴約 20%,因為輸出 token 大約是 1.7 倍。快取降價大約省 1.40 美元;若不降,任務約 5.16 美元。xhigh 得 65,任務約 2.72 美元。

01

科學智慧體與知識工作

廠商寫 GDPval-AA v2 為 1853,Opus 5 為 1824。AA 複測同一 1853 Elo,並寫與 Opus 的信賴區間重疊。AutomationBench 31.4%,CursorBench 3.2.0 為 73.4%。HLE 廠商寫無工具 60.9%、有工具 65.0%;AA 自己的 HLE 是 59.1%。套件名字必須寫上。

02

實驗室科學案例仍是廠商敘事

Mythos 用開源蛋白設計工具,外送兩家機構驗證:12 個靶點命中率近 50%,三枚 Adaptyv 靶點親和力約為競賽最佳的 10 倍。Fable 用麥哲倫雷達做了約三分之一金星的更高解析度高程圖。Mythos 還為七個開源生物模型寫 GPU 核,官方寫最高約 2.5 倍。這些不是公開重現包。

03

閘門更準,不等於人人可做滲透

官方寫網路防護誤攔少約 60%,Fable 現可用於發現漏洞,但利用、滲透測試與二進位掃洞仍轉到 Opus。Enterprise Frontier Safeguards 把監控資料放在客戶雲上,秋季分階段;此前符合條件的客戶可對 Fable 5.1 使用零留存。8 月 2 日後的模型依歐盟實務加不可見浮水印。

說法能核對的來源讀法
Science 52.6%;TB 4.0 為 55.8% / 60.9%anthropic.com 2026-09-01廠商自跑,科學榜標準誤約 ±3.5–4.5
AA 指數 max 66;任務約 3.76 美元Artificial Analysis 2026-09-01第三方指數,預設回退約 4% token
快取讀 0.25 美元;列表價 10 / 50Anthropic 價目讀更便宜,輸出仍貴;任務帳單另算

Anthropic:Claude Fable 5.1 與 Claude Mythos 5.1 是同一模型,只是閘門級別不同。

# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1          # generally available
sku: claude-mythos-5-1         # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M       # was $1.00
tb_science_0.1: 52.6%          # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos   # vendor
aa_index_max: 66               # default fallback ~4%
aa_task_cost_max: $3.76

讀法與界線

自報榜 ≠ 第三方指數
Science 52.6%、HLE 65.0% 是實驗室點名。AA 66 與 AA 的 HLE 59.1% 是另一套 harness。不要揉成一個冠軍。
Mythos SKU ≠ 人人可訂
受信任通道面向核過的防禦與生命科學方。更鬆的閘門是存取條件,不是開源檢查點。
新聞頁不是會議說明書
只解釋發布與評測。要約短會白板,用 wbmeet 建房,見 如何建立與加入房間

還想核對的問題

Fable 5.1 和 Mythos 5.1 是不是同一個權重?

官方寫「同一模型、不同閘門」。公開文件沒有給出權重雜湊或可下載檢查點。採購時按兩個 SKU、兩套存取策略處理。

52.6% 和 66 哪個是「官方分」?

都不是監管結論。52.6% 是 Anthropic 自報的 Terminal-Bench-Science。66 是 AA 在 max 加預設回退下的指數。寫實驗紀錄時把套件與努力檔寫上。

Pro / Team 訂閱能直接選 Mythos 嗎?

不能。Mythos 走核驗通道,現階段以美國機構為主。CVP 的 Mythos 檔官方寫「不久後」,沒有給出全面開放日。

這能證明 Anthropic 已超過其他實驗室嗎?

不能單獨當皇冠。AA 寫 66 是他們測過的最高分,但 GDPval 與 Opus 的區間重疊,科學榜帶標準誤。本頁只拆發布結構。

免費開始開會