Muse Spark 1.3 2026: AA-Intelligence-Index 61 erklärt
Muse Spark 1.3 tritt ins AA-Gleichstandsband mit Grok und GPT. xhigh und max zuerst trennen, dann rangieren.
Meta hat Muse Spark 1.3 am 2. September 2026 ausgeliefert. OfficeChai hat es am nächsten Tag mit dem Artificial-Analysis-Index abgeglichen: xhigh erreicht 61 und liegt gleichauf mit Grok 4.6 und GPT-5.6 Sol — kein laboreigener Harness.
Die Suchphrase ist Muse Spark 1.3 und der Artificial Analysis Intelligence Index. Es folgt die AA-Release-Seite, OfficeChais Chart vom 3. Sep. 2026 sowie CryptoBriefing / OpenRouter zum Start am 2. Sep. Ein Indexpunkt ist keine allgemeine Krone.
Was die Indexseite druckt
AA kennzeichnet 1.3 als proprietäres September-2026-Release, Gewichte „Not publicly available“. Intelligence Index v4.1.1 mischt neun Evals: GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR. Karte: Text/Bild/Video rein, Text raus, Kontext ~1 Mio. Tokens.
Das Chart lesen
- 1
Dritte-Partei-Komposit, kein Vendor-Harness
OfficeChai nennt Wissensarbeit, Agenten, Coding und wissenschaftliches Reasoning. Das ist die Mischung der Bewertungsfirma, keine unveröffentlichte Meta-Suite. Gleiche Regel wie in der Gemini-3.7-Flash-AA-Notiz: Index zuerst, Produkt danach.
- 2
Raus aus dem „nächsten Tier“
OfficeChai: etwa 57 für 1.2, 51 für 1.1, 43 für das April-Original; der 4-Punkte-Schritt 1.2→1.3 ist der größte der Familie. Im Chart: Fable 5.1 (max+fallback) 66, Opus 5 (max) 63; xhigh gleichauf mit Grok 4.6 (high) und GPT-5.6 Sol (max) bei 61. Kimi K3 und GLM-5.3 bei 60, Gemini 3.8 Flash (high) bei 59. Safety: Fable 5.
- 3
Tempo und Task-Preis sind getrennte Spalten
AA nennt für xhigh ~182 Tokens/s und etwa 0,55 $ pro Intelligence-Index-Task. OfficeChai zitiert ein schnelleres Chart (235); diese Seite folgt der AA-Release-Seite. CryptoBriefing gibt ~20 % weniger Tool-Calls und ~25 % weniger Tokens gegenüber 1.2 weiter — Vendor-Effizienz, keine AA-Reproduktion.
Wo es live ist
CryptoBriefing: Muse Code (Beta-Coding-Agent) und Meta Model API. OpenRouter listet meta/muse-spark-1.3 vom 2. Sep. 2026 bei etwa 1,25 / 4,25 $ pro Million Input/Output-Tokens, 1M Kontext.
Max-Reasoning ist noch kein volles Public-SKU
CryptoBriefing: ein „max reasoning“-Modus wartet auf weitere Safety-Tests. AA druckt bereits eine max-Zeile mit 62, Preis und Tempo leer. Eine Chartzeile ist kein API-Produkt für alle.
Kontrolle ist eine andere Achse
Ein höherer Index beantwortet kein kontrollierbares Deployment. Siehe Guidelight. Gewichte geschlossen — kein Open-Checkpoint-Audit.
| Aussage | Prüfbare Quelle | Lesart |
|---|---|---|
| xhigh 61 / max 62 | AA-Release-Seite Muse Spark 1.3 | Effort-Zeilen zuerst trennen |
| Gleichstand 61 mit Grok 4.6 und GPT-5.6 Sol | OfficeChai 2026-09-03 | Chart des Artikels, kein AA-Gesamtranking |
| Start 2. Sep.; weniger Tools/Tokens | CryptoBriefing / OpenRouter | Datum prüfbar; 20%/25% ist Vendor-Sprache |
OfficeChai: 1.3 ist das erste Muse-Spark-Release, das mit den Top-Zeilen von OpenAI und xAI gleichzieht statt im nächsten Tier zu sitzen.
# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02 (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61 · max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly availableGrenzen
- Komposit ≠ Einzeldisziplin-Krone
- Neun gewichtete Evals. Coding- oder Science-Scheiben können hinter höheren Opus-/Fable-Zeilen bleiben.
- Gleichstand ≠ tauschbare APIs
- Latenz, Preis, Tool-Spuren und Content-Policy unterscheiden sich. OpenRouter-Listenpreise sind nicht AA’s Dollar-pro-Task.
- Keine Meeting-Produktseite
- Nur Release und Eval. Für ein kurzes Board: wbmeet und Raum erstellen.
Fragen zum Gegenprüfen
Ist 61 oder 62 „offiziell“?
Beide sind AA-Zeilen zu 1.3. OfficeChais „Frontier eingeholt“ nutzt xhigh=61. Effort-Stufe in Kauf- oder Repro-Notizen nennen.
Warum weichen Tempozahlen ab?
Die AA-Release-Seite nennt ~182 Tokens/s für xhigh. OfficeChai zitiert 235. Diese Seite zitiert AA und markiert 235 als anderes Chart.
Gewichte selbst hosten?
AA: nicht öffentlich. Heute Hosted-API / Muse Code, kein Hugging-Face-Checkpoint.
Beweis, dass Meta Anthropic überholt hat?
Nein. Im selben OfficeChai-Chart bleibt Fable 5.1 bei 66 und Opus 5 bei 63. 1.3 ist in die Gleichstandsband eingetreten, nicht auf Platz eins.