Muse Spark 1.3是什麼:2026年AA智能指數61分解析

Meta 的 Muse Spark 1.3 在 AA 指數上進入與 Grok、GPT 頂檔並列的區間。先分 xhigh/max,再談名次。

Meta 在 2026 年 9 月 2 日推出 Muse Spark 1.3。OfficeChai 隔日對照 Artificial Analysis 指數:xhigh 檔打到 61,與 Grok 4.6、GPT-5.6 Sol 並列,而不是再報一份實驗室自有榜。

檢索詞是 Muse Spark 1.3Artificial Analysis Intelligence Index。以下依 AA 發布頁、OfficeChai 2026-09-03 對照圖,以及 CryptoBriefing / OpenRouter 對 9 月 2 日上線的核對。指數分不是通用冠軍證書。

4 月:Muse Spark7–8 月:1.1 / 1.29 月 2 日:1.3

指數頁上寫了什麼

AA 發布頁把 1.3 標成 2026 年 9 月專有發布,權重「Not publicly available」。Intelligence Index v4.1.1 合成九項:GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR。卡片寫明輸入文本/圖像/影片,輸出文本,上下文約 100 萬 token。

61
xhigh 的 Intelligence Index
62
max 的 Intelligence Index
182 t/s
AA 測得的 xhigh 輸出速度

怎麼讀這張圖

  1. 1

    第三方合成,不是自報 harness

    OfficeChai 寫明指數涵蓋知識工作、智能體、程式與科學推理。這是評測公司的合成分,不是 Meta 未公開套件。和本站 Gemini 3.7 Flash 的 AA 筆記 同一口徑:先認指數,再談產品。

  2. 2

    從「下一檔」擠進並列帶

    OfficeChai:1.2 約 57、1.1 約 51、4 月首版約 43;1.2→1.3 的 4 分是該系列單次最大跳。圖上 Fable 5.1(max+fallback)66、Opus 5(max)63;xhigh 與 Grok 4.6(high)、GPT-5.6 Sol(max)同為 61。Kimi K3 與 GLM-5.3 各 60,Gemini 3.8 Flash(high)59。安全評測另見 Fable 5 安全評估

  3. 3

    速度與任務價要分開看

    AA 給 xhigh 約 182 token/秒、每項 Intelligence Index 任務約 0.55 美元。OfficeChai 另引一張更樂觀的速度圖(235 token/秒);本頁以 AA 發布頁為準。CryptoBriefing 轉述相對 1.2:工具呼叫少約 20%、token 少約 25%——這是廠商效率說法,不是 AA 表上的獨立重現。

01

上線管道

CryptoBriefing:可透過 Muse Code(測試編碼智能體)與 Meta Model API 使用。OpenRouter 列出 meta/muse-spark-1.3,日期 2026-09-02,標價約每百萬 token 輸入 1.25 美元、輸出 4.25 美元,上下文 1M。

02

max 推理檔未隨 1.3 全日公開

CryptoBriefing 寫「max reasoning」還要再過安全測試才出。AA 已給 max 一行 62 分,但價格與速度在發布頁上為空。不要把圖表行當成已對所有人開放的 API SKU。

03

控制面仍是另一條線

指數上升不回答可控部署。前沿控制評估見 Guidelight。權重未公開,不能按開源檢查點去稽核。

說法能核對的來源讀法
xhigh 61 / max 62AA Muse Spark 1.3 發布頁先分檔,再比分
與 Grok 4.6、GPT-5.6 Sol 並列 61OfficeChai 2026-09-03該文對照圖,不是 AA 全文排名
9 月 2 日上線;工具/token 更省CryptoBriefing / OpenRouter發布日可核;20%/25% 是廠商口徑

OfficeChai:1.3 是該系列首次與 OpenAI、xAI 頂檔並列,而不再落在「下一檔」集群。

# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02  (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61  ·  max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly available

讀法與界線

合成指數 ≠ 單項冠軍
九項加權。編碼或科學單科仍可能輸給更高分的 Opus/Fable。
並列 ≠ 可互換
延遲、價格、工具軌跡、內容政策都不同。OpenRouter 標價與 AA 的「每任務美元」也不是同一口徑。
新聞頁不是會議說明書
只解釋發布與評測。要約短會白板,用 wbmeet 建房,見 如何建立與加入房間

還想核對的問題

61 和 62 哪個算「官方分」?

都是 AA 對 1.3 的列。OfficeChai 的「追平前沿」敘事用 xhigh=61。採購或重現實驗要寫明力度檔。

為什麼速度數字對不上?

AA 發布頁寫 xhigh 約 182 token/秒。OfficeChai 另引 235。本頁引用 AA 頁,並把 235 標成另一張圖,避免混用。

能下載權重自託管嗎?

AA 寫 Not publicly available。目前是託管 API/Muse Code,不是 Hugging Face 開源檢查點。

這能證明 Meta 已超過 Anthropic 嗎?

不能。同一張 OfficeChai 圖上 Fable 5.1 仍是 66、Opus 5 是 63。1.3 是擠進並列帶,不是登頂。

免費開始開會