Muse Spark 1.2 (xHigh) — benchmark results

Provider: Meta. Released 2026-08-05. Access: API.

Unified ELO 1933 ± 17, rank #41 of 1803 rated models, from 54 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Long Context Reasoning83.33Accuracy (%)100
Vals AI Finance Agent v260.6Accuracy (%)100
Vals AI Harvey Legal Agent Bench25.42Accuracy (%)100
Vals AI TaxEval v280.38Accuracy (%)100
Chatbot Arena (Text)1498Elo99.2
Vals AI MedScribe90.06Accuracy (%)98.7
Epoch AI - Scicode56.37Score98.6
Artificial Analysis Intelligence Index56.76Intelligence Index98
AA Omniscience27.2Score97.8
AA Humanity's Last Exam45.46Accuracy (%)97.7
Vals AI CorpFin v270.94Accuracy (%)96.9
AA Omniscience - Software Engineering (SWE) - Rust84Accuracy (%)96.4

Interactive version: theaggregate.ai/model?slug=muse-spark-1-2-xhigh · How It Works · Data refreshed daily, snapshot 2026-08-08.