Muse Spark 1.3 2026: что значит 61 в индексе AA
Muse Spark 1.3 вошла в полосу ничьей AA с Grok и GPT. Сначала разделите xhigh и max, потом говорите о месте.
Meta выпустила Muse Spark 1.3 2 сентября 2026. На следующий день OfficeChai сверил её с индексом Artificial Analysis: режим xhigh набрал 61 и сравнялся с Grok 4.6 и GPT-5.6 Sol — сторонний индекс, не таблица лаборатории.
Запрос — Muse Spark 1.3 и Artificial Analysis Intelligence Index. Дальше — страница релиза AA, график OfficeChai от 3 сент. 2026 и CryptoBriefing / OpenRouter по запуску 2 сент. Пункт индекса — не общая корона.
Что печатает страница индекса
AA помечает 1.3 как проприетарный релиз сентября 2026, веса «Not publicly available». Intelligence Index v4.1.1 смешивает девять оценок: GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR. Карточка: вход текст / изображение / видео, выход текст, контекст ~1 млн токенов.
Как читать график
- 1
Сторонний композит, не vendor-harness
OfficeChai описывает работу со знанием, агентов, код и научное рассуждение. Это смесь оценщика, не закрытый набор Meta. То же правило, что в заметке AA по Gemini 3.7 Flash: сначала имя индекса.
- 2
Из кластера «следующего яруса»
OfficeChai: около 57 у 1.2, 51 у 1.1, 43 у апрельского оригинала; шаг в 4 пункта 1.2→1.3 — крупнейший в семействе. На графике Fable 5.1 (max+fallback) — 66, Opus 5 (max) — 63; xhigh вничью с Grok 4.6 (high) и GPT-5.6 Sol (max) при 61. Kimi K3 и GLM-5.3 — 60, Gemini 3.8 Flash (high) — 59. Оценки безопасности: Fable 5.
- 3
Скорость и цена задачи — разные столбцы
AA даёт xhigh ~182 токена/с и около 0,55 $ на задачу Intelligence Index. OfficeChai цитирует более быстрый график (235); эта страница следует странице AA. CryptoBriefing передаёт ~20% меньше вызовов инструментов и ~25% меньше токенов против 1.2 — язык эффективности вендора, не репродукция AA.
Где это в проде
CryptoBriefing: Muse Code (бета-агент кода) и Meta Model API. OpenRouter указывает meta/muse-spark-1.3 от 2 сент. 2026, около 1,25 / 4,25 $ за миллион входных/выходных токенов, контекст 1M.
Max reasoning ещё не полный публичный SKU
CryptoBriefing: режим «max reasoning» ждёт дополнительных тестов безопасности. AA уже печатает строку max с 62, цена и скорость пусты. Строка графика — не API, который все могут купить.
Контроль — другая ось
Более высокий индекс не отвечает на контролируемый деплой. См. Guidelight. Веса закрыты: это не аудит открытого чекпоинта.
| Формулировка | Проверяемый источник | Как читать |
|---|---|---|
| xhigh 61 / max 62 | Страница релиза AA Muse Spark 1.3 | Сначала разделить строки усилия |
| Ничья 61 с Grok 4.6 и GPT-5.6 Sol | OfficeChai 2026-09-03 | График статьи, не полный рейтинг AA |
| Старт 2 сент.; меньше инструментов/токенов | CryptoBriefing / OpenRouter | Дата проверяема; 20%/25% — язык вендора |
OfficeChai: 1.3 — первый Muse Spark, который сравнялся с верхними строками OpenAI и xAI, а не остался в кластере следующего яруса.
# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02 (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61 · max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly availableГраницы
- Композит ≠ корона одной задачи
- Девять взвешенных оценок. Срезы кода или науки всё ещё могут уступать более высоким строкам Opus / Fable.
- Ничья ≠ взаимозаменяемые API
- Задержка, цена, трассы инструментов и политика контента различаются. Прайс OpenRouter — не столбец долларов за задачу у AA.
- Это не бриф про совещания
- Только релиз и оценка. Для короткой доски: wbmeet и создайте комнату.
Вопросы для сверки
61 или 62 — «официальный» балл?
Обе строки AA по 1.3. Сюжет OfficeChai «догнали фронтир» берёт xhigh=61. Уровень усилия указывайте в любой покупке или репродукции.
Почему расходятся скорости?
Страница AA даёт ~182 токена/с для xhigh. OfficeChai цитирует 235. Эта страница цитирует AA и помечает 235 как другой график.
Можно ли свой хост весов?
AA: не публичны. Сейчас hosted API / Muse Code, не чекпоинт Hugging Face.
Доказательство, что Meta обошла Anthropic?
Нет. На том же графике OfficeChai у Fable 5.1 по-прежнему 66, у Opus 5 — 63. 1.3 вошла в полосу ничьей, не на первое место.