Muse Spark 1.3 2026 : l’indice AA à 61, ce que ça dit

Muse Spark 1.3 entre dans la bande d’égalité AA avec Grok et GPT. Séparer xhigh et max avant tout classement.

Meta a livré Muse Spark 1.3 le 2 septembre 2026. Le lendemain, OfficeChai l’a recoupé avec l’indice Artificial Analysis : le réglage xhigh marque 61, à égalité avec Grok 4.6 et GPT-5.6 Sol — un indice tiers, pas une table de labo.

La requête est Muse Spark 1.3 et l’Artificial Analysis Intelligence Index. Suit la page de sortie AA, le graphique OfficeChai du 3 sept. 2026, et CryptoBriefing / OpenRouter sur le lancement du 2 sept. Un point d’indice n’est pas une couronne générale.

Avril : Muse SparkJuil.–août : 1.1 / 1.22 sept. : 1.3

Ce que la page d’indice imprime

AA classe 1.3 en sortie propriétaire de septembre 2026, poids « Not publicly available ». L’Intelligence Index v4.1.1 mélange neuf évals : GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR. Fiche : texte / image / vidéo en entrée, texte en sortie, contexte ~1 M de tokens.

61
Intelligence Index (xhigh)
62
Intelligence Index (max)
182 t/s
Débit de sortie AA pour xhigh

Lire le graphique

  1. 1

    Composite tiers, pas un harness vendor

    OfficeChai décrit le travail de connaissance, les agents, le code et le raisonnement scientifique. C’est le mélange de l’évaluateur, pas une suite Meta non publiée. Même règle que notre note AA Gemini 3.7 Flash : nommer l’indice avant le produit.

  2. 2

    Hors du cluster « palier suivant »

    OfficeChai : environ 57 pour 1.2, 51 pour 1.1, 43 pour l’original d’avril ; le saut de 4 points 1.2→1.3 est le plus grand de la famille. Sur ce graphique : Fable 5.1 (max+fallback) 66, Opus 5 (max) 63 ; xhigh à égalité avec Grok 4.6 (high) et GPT-5.6 Sol (max) à 61. Kimi K3 et GLM-5.3 à 60, Gemini 3.8 Flash (high) à 59. Évals de sûreté : Fable 5.

  3. 3

    Vitesse et prix par tâche sont des colonnes distinctes

    AA donne à xhigh ~182 tokens/s et environ 0,55 $ par tâche d’Intelligence Index. OfficeChai cite un graphique plus rapide (235) ; cette page suit la page AA. CryptoBriefing relaie ~20 % d’appels d’outils et ~25 % de tokens en moins face à 1.2 — langage d’efficacité vendor, pas une reproduction AA.

01

Où c’est en ligne

CryptoBriefing : Muse Code (agent de code bêta) et Meta Model API. OpenRouter liste meta/muse-spark-1.3 au 2 sept. 2026, environ 1,25 / 4,25 $ par million de tokens entrée/sortie, contexte 1 M.

02

Le max reasoning n’est pas encore un SKU public complet

CryptoBriefing : un mode « max reasoning » attend encore des tests de sûreté. AA imprime déjà une ligne max à 62, prix et débit vides. Une ligne de graphique n’est pas une API achetable par tous.

03

Le contrôle est un autre axe

Un indice plus haut ne répond pas au déploiement contrôlable. Voir Guidelight. Poids fermés : ce n’est pas un audit de checkpoint ouvert.

FormulationSource vérifiableLecture
xhigh 61 / max 62Page de sortie AA Muse Spark 1.3Séparer d’abord les lignes d’effort
Égalité à 61 avec Grok 4.6 et GPT-5.6 SolOfficeChai 2026-09-03Graphique de l’article, pas le classement AA entier
Sortie le 2 sept. ; moins d’outils/tokensCryptoBriefing / OpenRouterDate vérifiable ; 20 %/25 % = langage vendor

OfficeChai : 1.3 est la première sortie Muse Spark à égalité avec les lignes hautes d’OpenAI et xAI, hors du cluster du palier suivant.

# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02  (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61  ·  max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly available

Limites

Composite ≠ couronne monotâche
Neuf évals pondérées. Les tranches code ou science peuvent encore suivre des lignes Opus / Fable plus hautes.
Égalité ≠ API interchangeables
Latence, prix, traces d’outils et politique de contenu diffèrent. Les prix OpenRouter ne sont pas la colonne dollars-par-tâche d’AA.
Cette page n’est pas une fiche réunion
Sortie et éval seulement. Pour un huddle court : wbmeet et créer une salle.

Questions à recouper

61 ou 62 est-il le score « officiel » ?

Les deux sont des lignes AA pour 1.3. Le récit OfficeChai « rattraper la frontière » utilise xhigh=61. Noter l’effort sur tout achat ou repro.

Pourquoi les débits divergent-ils ?

La page AA indique ~182 tokens/s pour xhigh. OfficeChai cite 235. Cette page cite AA et marque 235 comme un autre graphique.

Peut-on auto-héberger les poids ?

AA : non publics. Aujourd’hui API hébergée / Muse Code, pas un checkpoint Hugging Face.

Preuve que Meta a dépassé Anthropic ?

Non. Sur le même graphique OfficeChai, Fable 5.1 reste à 66 et Opus 5 à 63. 1.3 est entré dans la bande d’égalité, pas en tête.

Démarrer une réunion gratuite