Claude Fable 5.1 2026: Mythos, цена кэша и оценки
Один вес, два шлюза: публичный Fable 5.1 и закрытый Mythos 5.1. Сначала SKU, потом 52,6% и AA 66.
Anthropic 1 сентября 2026 выпустила два SKU Claude 5.1: публичный Fable и Mythos за доверенным доступом. Та же основа, не новое флагманское семейство.
Запрос — Claude Fable 5.1 и Claude Mythos 5.1. Дальше — пост anthropic.com и заметка Artificial Analysis от 1 сентября. Вендорские бенчи — не независимая репродукция. Предыдущая заметка о вкусе/безопасности: TASTE / Fable 5.
Что печатает пост запуска
Fable 5.1 заявлен для кода, knowledge work и длинного решения задач. Claude Code по умолчанию High effort; Cowork и claude.ai — Medium. Прайс без изменений: 10 / 50 $ за миллион токенов. Меняется чтение кэша — 0,25 $. Оценка опирается на четыре недели августа: примерно на 25% дешевле на типичной нагрузке, до примерно 45%, когда кэш доминирует. Имя API: claude-fable-5-1.
Как читать три строки
- 1
Сначала публичный SKU, потом закрытый
Разработчики получают Fable в API, claude.ai, Claude Code и трёх облаках. Mythos требует программу верификации, не тот же ключ подписки. Anthropic также пишет, что Claude Security теперь на Mythos 5.1: сканирует репозитории и предлагает патчи на ревью человеку.
- 2
Научный бенч вендора — не Terminal-Bench AA
Официально Terminal-Bench-Science 0.1: 52,6%. Публичный лидерборд (другой harness) ставит Opus 5 на 30,0% и Fable 5 на 21,4%; лаборатория воспроизводит 29,0% и 24,7%, оба в шуме. AA меряет Terminal-Bench v2.1: 91,4% на max. Не склеивать 52,6% и 91,4% в одну корону. Полоса ничьей: Muse Spark 1.3.
- 3
Дешевле кэш — не дешевле задача
AA: 66 на max с дефолтным фолбэком, впереди Opus 5 (63), Fable 5 (62) и GPT-5.6 Sol (61). Фолбэк отдал около 4% выходных токенов в Opus 4.8 или Opus 5. Стоимость около 3,76 $ за задачу индекса против 3,14 $ у Fable 5 — примерно на 20% дороже — потому что выходных токенов около 1,7×. Срез кэша экономит около 1,40 $; без него около 5,16 $. xhigh даёт 65 при около 2,72 $.
Научные агенты и knowledge work
Anthropic пишет GDPval-AA v2 1853 против 1824 у Opus 5. AA повторяет 1853 Elo и пересекающиеся доверительные интервалы с Opus. AutomationBench 31,4%; CursorBench 3.2.0 — 73,4%. Vendor HLE: 60,9% без инструментов, 65,0% с инструментами; собственный HLE AA — 59,1%. Указывайте набор.
Научные кейсы лаборатории остаются нарративом вендора
Mythos использовал открытые инструменты дизайна белков; две внешние организации валидировали: почти 50% попаданий на 12 мишенях и примерно 10× лучшие аффинности Adaptyv на трёх мишенях. Fable построил более детальную карту высот примерно для трети Венеры по радару Magellan. Mythos написал GPU-ядра для семи открытых биомоделей; официально до примерно 2,5×. Это не публичный пакет воспроизведения.
Точнее шлюзы — не публичный pentest API
Anthropic пишет примерно на 60% меньше ложных кибер-блоков. Fable теперь может искать уязвимости; генерация эксплойтов, пентест и бинарное сканирование по-прежнему уходят в Opus. Enterprise Frontier Safeguards держит данные мониторинга в облаке клиента, поэтапно этой осенью; подходящие клиенты до этого могут Fable 5.1 с нулевым хранением. Модели после 2 августа несут невидимый водяной знак по практике ЕС.
| Формулировка | Проверяемый источник | Как читать |
|---|---|---|
| Science 52,6%; TB 4.0 55,8% / 60,9% | anthropic.com 2026-09-01 | Прогон вендора; SE науки около ±3,5–4,5 |
| AA max 66; ~3,76 $ / задача | Artificial Analysis 2026-09-01 | Сторонний индекс; дефолтный фолбэк ~4% токенов |
| Чтение кэша 0,25 $; прайс 10 / 50 | Карточка цен Anthropic | Чтения дешевле, выход дорог; счёт за задачу отдельно |
Anthropic: Claude Fable 5.1 и Claude Mythos 5.1 — одна и та же модель, но с разными уровнями защит.
# Claude 5.1 · Anthropic 2026-09-01 · AA 2026-09-01
sku: claude-fable-5-1 # generally available
sku: claude-mythos-5-1 # trusted access
price: $10 / $50 per 1M
cache_read: $0.25 per 1M # was $1.00
tb_science_0.1: 52.6% # vendor; SE ±3.5–4.5
tb_4.0: 55.8% / 60.9% Mythos # vendor
aa_index_max: 66 # default fallback ~4%
aa_task_cost_max: $3.76Границы
- Таблицы вендора ≠ сторонний индекс
- Science 52,6% и HLE 65,0% названы лабораторией. AA 66 и HLE AA 59,1% — другой harness. Не склеивать в одну корону.
- Mythos SKU ≠ ключ для всех
- Доверенный доступ для проверенных защитников и life scientists. Более мягкие шлюзы — условие доступа, не открытый чекпоинт.
- Это не бриф про совещания
- Только релиз и оценка. Для короткой доски: wbmeet и создайте комнату.
Вопросы для сверки
У Fable 5.1 и Mythos 5.1 одни и те же веса?
Anthropic пишет «одна и та же модель» с разными уровнями защит. Публичные документы не дают хеш весов и скачиваемый чекпоинт. Два SKU, две политики доступа.
52,6% или 66 — «официальный» балл?
Ни то ни другое не вывод регулятора. 52,6% — Terminal-Bench-Science Anthropic. 66 — AA на max с дефолтным фолбэком. Имя набора и строку effort указывайте в любой лабораторной заметке.
Можно ли выбрать Mythos в плане Pro или Team?
Нет. Mythos идёт через программы верификации и пока ограничен организациями США. Доступ CVP класса Mythos записан как «ближайшее будущее», без даты широкого открытия.
Доказательство, что Anthropic обошла другие лаборатории?
Не корона само по себе. AA называет 66 высшим из своих измерений, но интервалы GDPval пересекаются с Opus, а научный бенч несёт стандартную ошибку. Эта страница только разбирает релиз.