Muse Spark 1.3란: 2026 AA 지능지수 61점 해설
Muse Spark 1.3이 AA 지수에서 Grok·GPT 최상단과 동점대에 들어갔다. xhigh와 max를 나눈 뒤 순위를 말하라.
Meta는 2026년 9월 2일 Muse Spark 1.3을 냈다. 다음날 OfficeChai는 Artificial Analysis 지수와 맞춰 xhigh가 61점, Grok 4.6·GPT-5.6 Sol과 동점이라고 썼다. 랩 자체 표가 아니다.
검색어는 Muse Spark 1.3과 Artificial Analysis Intelligence Index다. 아래는 AA 릴리스 페이지, OfficeChai 2026-09-03 차트, CryptoBriefing / OpenRouter의 9월 2일 출시 대조다. 지수 점은 만능 왕관이 아니다.
지수 페이지에 적힌 것
AA는 1.3을 2026년 9월 전용 릴리스로 두고 가중치는 “Not publicly available”이다. Intelligence Index v4.1.1은 아홉 평가의 합성이다: GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR. 입력은 텍스트/이미지/비디오, 출력은 텍스트, 컨텍스트는 약 100만 토큰.
차트를 읽는 법
- 1
제3자 합성이며 벤더 하니스가 아니다
OfficeChai는 지식 업무, 에이전트, 코딩, 과학 추론을 덮는다고 쓴다. 평가사 합성이며 Meta의 비공개 스위트가 아니다. 본 사이트의 Gemini 3.7 Flash AA 메모와 같다: 지수 이름을 먼저.
- 2
“다음 티어”에서 동점대로
OfficeChai: 1.2 약 57, 1.1 약 51, 4월 초판 약 43. 1.2→1.3의 4점이 시리즈 최대 점프. 차트에서 Fable 5.1(max+fallback) 66, Opus 5(max) 63. xhigh는 Grok 4.6(high), GPT-5.6 Sol(max)과 61로 동점. Kimi K3·GLM-5.3은 60, Gemini 3.8 Flash(high)는 59. 안전 평가는 Fable 5.
- 3
속도와 작업 단가는 다른 열
AA는 xhigh를 초당 약 182토큰, Intelligence Index 작업당 약 0.55달러로 둔다. OfficeChai는 더 빠른 차트(235)를 인용한다. 이 페이지는 AA 릴리스 페이지를 따른다. CryptoBriefing은 1.2 대비 도구 호출 약 20%·토큰 약 25% 감소를 전한다. 벤더 효율 표현이며 AA 표의 독립 재현이 아니다.
출시 채널
CryptoBriefing: Muse Code(베타 코딩 에이전트)와 Meta Model API. OpenRouter는 meta/muse-spark-1.3을 2026-09-02, 백만 토큰당 입력/출력 약 1.25/4.25달러, 컨텍스트 1M으로 올린다.
max 추론은 아직 전면 공개 SKU가 아니다
CryptoBriefing은 “max reasoning”이 추가 안전 시험을 기다린다고 쓴다. AA는 max 행 62를 찍지만 가격·속도는 비어 있다. 차트 행을 누구나 살 수 있는 API로 보지 말라.
제어는 다른 축
지수 상승이 통제 가능한 배포를 답하지 않는다. Guidelight를 보라. 가중치는 닫혀 있어 오픈 체크포인트 감사가 아니다.
| 표현 | 대조 출처 | 읽는 법 |
|---|---|---|
| xhigh 61 / max 62 | AA Muse Spark 1.3 릴리스 페이지 | 노력 행을 먼저 나눈다 |
| Grok 4.6·GPT-5.6 Sol과 61 동점 | OfficeChai 2026-09-03 | 그 기사 차트이지 AA 전체 순위가 아님 |
| 9월 2일 출시; 도구/토큰 절감 | CryptoBriefing / OpenRouter | 날짜는 대조 가능. 20%/25%는 벤더 표현 |
OfficeChai: 1.3은 OpenAI·xAI 최상단과 동점이 된 첫 Muse Spark이며, 다음 티어 클러스터를 벗어났다.
# Muse Spark 1.3 · Artificial Analysis
# release: 2026-09-02 (CryptoBriefing / OpenRouter)
family: April → 1.1 Jul → 1.2 Aug → 1.3 Sep
index: AA Intelligence Index v4.1.1 (9 evals)
xhigh: 61 · max: 62
xhigh_speed_aa: 182 tok/s
xhigh_cost_per_index_task: $0.55
weights: not publicly available읽는 법과 경계
- 합성 지수 ≠ 단일 과제 왕관
- 아홉 가중 평가. 코딩이나 과학 조각에서는 더 높은 Opus/Fable에 질 수 있다.
- 동점 ≠ 호환 API
- 지연, 가격, 도구 궤적, 콘텐츠 정책이 다르다. OpenRouter 표시가는 AA 작업당 달러가 아니다.
- 회의 제품 설명이 아니다
- 출시와 평가만. 짧은 보드가 필요하면 wbmeet와 방 만들기.
확인하고 싶은 질문
61과 62 중 무엇이 공식인가?
둘 다 1.3의 AA 행이다. OfficeChai의 “프론티어 추격”은 xhigh=61. 구매·재현 메모에 노력 설정을 적어라.
속도 숫자가 왜 다른가?
AA 릴리스 페이지는 xhigh 초당 약 182토큰. OfficeChai는 235를 인용한다. 이 페이지는 AA를 인용하고 235는 다른 차트로 표시한다.
가중치를 자체 호스트할 수 있나?
AA는 비공개라고 쓴다. 지금은 호스트 API/Muse Code이며 Hugging Face 체크포인트가 아니다.
Meta가 Anthropic을 앞섰다는 증명인가?
아니다. 같은 OfficeChai 차트에서 Fable 5.1은 66, Opus 5는 63. 1.3은 동점대에 들어간 것이지 1등이 아니다.