Muse Spark 1.3 2026: AA-Intelligence-Index 61 erklärt

Muse Spark 1.3 tritt ins AA-Gleichstandsband mit Grok und GPT. xhigh und max zuerst trennen, dann rangieren.

Meta hat Muse Spark 1.3 am 2. September 2026 ausgeliefert. OfficeChai hat es am nächsten Tag mit dem Artificial-Analysis-Index abgeglichen: xhigh erreicht 61 und liegt gleichauf mit Grok 4.6 und GPT-5.6 Sol — kein laboreigener Harness.

Die Suchphrase ist Muse Spark 1.3 und der Artificial Analysis Intelligence Index. Es folgt die AA-Release-Seite, OfficeChais Chart vom 3. Sep. 2026 sowie CryptoBriefing / OpenRouter zum Start am 2. Sep. Ein Indexpunkt ist keine allgemeine Krone.

April: Muse SparkJul–Aug: 1.1 / 1.22. Sep.: 1.3

Was die Indexseite druckt

AA kennzeichnet 1.3 als proprietäres September-2026-Release, Gewichte „Not publicly available“. Intelligence Index v4.1.1 mischt neun Evals: GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR. Karte: Text/Bild/Video rein, Text raus, Kontext ~1 Mio. Tokens.

61
Intelligence Index (xhigh)
62
Intelligence Index (max)
182 t/s
AA-Ausgabegeschwindigkeit xhigh

Das Chart lesen

  1. 1

    Dritte-Partei-Komposit, kein Vendor-Harness

    OfficeChai nennt Wissensarbeit, Agenten, Coding und wissenschaftliches Reasoning. Das ist die Mischung der Bewertungsfirma, keine unveröffentlichte Meta-Suite. Gleiche Regel wie in der Gemini-3.7-Flash-AA-Notiz: Index zuerst, Produkt danach.

  2. 2

    Raus aus dem „nächsten Tier“

    OfficeChai: etwa 57 für 1.2, 51 für 1.1, 43 für das April-Original; der 4-Punkte-Schritt 1.2→1.3 ist der größte der Familie. Im Chart: Fable 5.1 (max+fallback) 66, Opus 5 (max) 63; xhigh gleichauf mit Grok 4.6 (high) und GPT-5.6 Sol (max) bei 61. Kimi K3 und GLM-5.3 bei 60, Gemini 3.8 Flash (high) bei 59. Safety: Fable 5.

  3. 3

    Tempo und Task-Preis sind getrennte Spalten

    AA nennt für xhigh ~182 Tokens/s und etwa 0,55 $ pro Intelligence-Index-Task. OfficeChai zitiert ein schnelleres Chart (235); diese Seite folgt der AA-Release-Seite. CryptoBriefing gibt ~20 % weniger Tool-Calls und ~25 % weniger Tokens gegenüber 1.2 weiter — Vendor-Effizienz, keine AA-Reproduktion.

01

Wo es live ist

CryptoBriefing: Muse Code (Beta-Coding-Agent) und Meta Model API. OpenRouter listet meta/muse-spark-1.3 vom 2. Sep. 2026 bei etwa 1,25 / 4,25 $ pro Million Input/Output-Tokens, 1M Kontext.

02

Max-Reasoning ist noch kein volles Public-SKU

CryptoBriefing: ein „max reasoning“-Modus wartet auf weitere Safety-Tests. AA druckt bereits eine max-Zeile mit 62, Preis und Tempo leer. Eine Chartzeile ist kein API-Produkt für alle.

03

Kontrolle ist eine andere Achse

Ein höherer Index beantwortet kein kontrollierbares Deployment. Siehe Guidelight. Gewichte geschlossen — kein Open-Checkpoint-Audit.

AussagePrüfbare QuelleLesart
xhigh 61 / max 62AA-Release-Seite Muse Spark 1.3Effort-Zeilen zuerst trennen
Gleichstand 61 mit Grok 4.6 und GPT-5.6 SolOfficeChai 2026-09-03Chart des Artikels, kein AA-Gesamtranking
Start 2. Sep.; weniger Tools/TokensCryptoBriefing / OpenRouterDatum prüfbar; 20%/25% ist Vendor-Sprache

OfficeChai: 1.3 ist das erste Muse-Spark-Release, das mit den Top-Zeilen von OpenAI und xAI gleichzieht statt im nächsten Tier zu sitzen.

# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02  (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61  ·  max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly available

Grenzen

Komposit ≠ Einzeldisziplin-Krone
Neun gewichtete Evals. Coding- oder Science-Scheiben können hinter höheren Opus-/Fable-Zeilen bleiben.
Gleichstand ≠ tauschbare APIs
Latenz, Preis, Tool-Spuren und Content-Policy unterscheiden sich. OpenRouter-Listenpreise sind nicht AA’s Dollar-pro-Task.
Keine Meeting-Produktseite
Nur Release und Eval. Für ein kurzes Board: wbmeet und Raum erstellen.

Fragen zum Gegenprüfen

Ist 61 oder 62 „offiziell“?

Beide sind AA-Zeilen zu 1.3. OfficeChais „Frontier eingeholt“ nutzt xhigh=61. Effort-Stufe in Kauf- oder Repro-Notizen nennen.

Warum weichen Tempozahlen ab?

Die AA-Release-Seite nennt ~182 Tokens/s für xhigh. OfficeChai zitiert 235. Diese Seite zitiert AA und markiert 235 als anderes Chart.

Gewichte selbst hosten?

AA: nicht öffentlich. Heute Hosted-API / Muse Code, kein Hugging-Face-Checkpoint.

Beweis, dass Meta Anthropic überholt hat?

Nein. Im selben OfficeChai-Chart bleibt Fable 5.1 bei 66 und Opus 5 bei 63. 1.3 ist in die Gleichstandsband eingetreten, nicht auf Platz eins.

Kostenloses Meeting starten