Muse Spark 1.3 2026 : l’indice AA à 61, ce que ça dit
Muse Spark 1.3 entre dans la bande d’égalité AA avec Grok et GPT. Séparer xhigh et max avant tout classement.
Meta a livré Muse Spark 1.3 le 2 septembre 2026. Le lendemain, OfficeChai l’a recoupé avec l’indice Artificial Analysis : le réglage xhigh marque 61, à égalité avec Grok 4.6 et GPT-5.6 Sol — un indice tiers, pas une table de labo.
La requête est Muse Spark 1.3 et l’Artificial Analysis Intelligence Index. Suit la page de sortie AA, le graphique OfficeChai du 3 sept. 2026, et CryptoBriefing / OpenRouter sur le lancement du 2 sept. Un point d’indice n’est pas une couronne générale.
Ce que la page d’indice imprime
AA classe 1.3 en sortie propriétaire de septembre 2026, poids « Not publicly available ». L’Intelligence Index v4.1.1 mélange neuf évals : GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR. Fiche : texte / image / vidéo en entrée, texte en sortie, contexte ~1 M de tokens.
Lire le graphique
- 1
Composite tiers, pas un harness vendor
OfficeChai décrit le travail de connaissance, les agents, le code et le raisonnement scientifique. C’est le mélange de l’évaluateur, pas une suite Meta non publiée. Même règle que notre note AA Gemini 3.7 Flash : nommer l’indice avant le produit.
- 2
Hors du cluster « palier suivant »
OfficeChai : environ 57 pour 1.2, 51 pour 1.1, 43 pour l’original d’avril ; le saut de 4 points 1.2→1.3 est le plus grand de la famille. Sur ce graphique : Fable 5.1 (max+fallback) 66, Opus 5 (max) 63 ; xhigh à égalité avec Grok 4.6 (high) et GPT-5.6 Sol (max) à 61. Kimi K3 et GLM-5.3 à 60, Gemini 3.8 Flash (high) à 59. Évals de sûreté : Fable 5.
- 3
Vitesse et prix par tâche sont des colonnes distinctes
AA donne à xhigh ~182 tokens/s et environ 0,55 $ par tâche d’Intelligence Index. OfficeChai cite un graphique plus rapide (235) ; cette page suit la page AA. CryptoBriefing relaie ~20 % d’appels d’outils et ~25 % de tokens en moins face à 1.2 — langage d’efficacité vendor, pas une reproduction AA.
Où c’est en ligne
CryptoBriefing : Muse Code (agent de code bêta) et Meta Model API. OpenRouter liste meta/muse-spark-1.3 au 2 sept. 2026, environ 1,25 / 4,25 $ par million de tokens entrée/sortie, contexte 1 M.
Le max reasoning n’est pas encore un SKU public complet
CryptoBriefing : un mode « max reasoning » attend encore des tests de sûreté. AA imprime déjà une ligne max à 62, prix et débit vides. Une ligne de graphique n’est pas une API achetable par tous.
Le contrôle est un autre axe
Un indice plus haut ne répond pas au déploiement contrôlable. Voir Guidelight. Poids fermés : ce n’est pas un audit de checkpoint ouvert.
| Formulation | Source vérifiable | Lecture |
|---|---|---|
| xhigh 61 / max 62 | Page de sortie AA Muse Spark 1.3 | Séparer d’abord les lignes d’effort |
| Égalité à 61 avec Grok 4.6 et GPT-5.6 Sol | OfficeChai 2026-09-03 | Graphique de l’article, pas le classement AA entier |
| Sortie le 2 sept. ; moins d’outils/tokens | CryptoBriefing / OpenRouter | Date vérifiable ; 20 %/25 % = langage vendor |
OfficeChai : 1.3 est la première sortie Muse Spark à égalité avec les lignes hautes d’OpenAI et xAI, hors du cluster du palier suivant.
# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02 (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61 · max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly availableLimites
- Composite ≠ couronne monotâche
- Neuf évals pondérées. Les tranches code ou science peuvent encore suivre des lignes Opus / Fable plus hautes.
- Égalité ≠ API interchangeables
- Latence, prix, traces d’outils et politique de contenu diffèrent. Les prix OpenRouter ne sont pas la colonne dollars-par-tâche d’AA.
- Cette page n’est pas une fiche réunion
- Sortie et éval seulement. Pour un huddle court : wbmeet et créer une salle.
Questions à recouper
61 ou 62 est-il le score « officiel » ?
Les deux sont des lignes AA pour 1.3. Le récit OfficeChai « rattraper la frontière » utilise xhigh=61. Noter l’effort sur tout achat ou repro.
Pourquoi les débits divergent-ils ?
La page AA indique ~182 tokens/s pour xhigh. OfficeChai cite 235. Cette page cite AA et marque 235 comme un autre graphique.
Peut-on auto-héberger les poids ?
AA : non publics. Aujourd’hui API hébergée / Muse Code, pas un checkpoint Hugging Face.
Preuve que Meta a dépassé Anthropic ?
Non. Sur le même graphique OfficeChai, Fable 5.1 reste à 66 et Opus 5 à 63. 1.3 est entré dans la bande d’égalité, pas en tête.