Muse Spark — benchmark results

Meta's Muse Spark model, a closed high-capability system tracked among the top ranked models. Provider: Meta. Released 2026-04-08. Access: Private.

Unified ELO 1871 ± 16, rank #86 of 1776 rated models, from 103 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM Stats (HealthBench Hard)42.8Score (%)100
LLM Stats (MedXpertQA)78.4Score (%)100
SEAL - MultiChallenge75.52Score100
SEAL - TutorBench68.55Score100
TutorBench68.55Score (self-reported)100
Vals AI TaxEval v277.68Accuracy (%)99.2
Chatbot Arena (Text)1488Elo98.4
Vals AI AIME96.88Accuracy (%)98.4
AA Humanity's Last Exam39.94Accuracy (%)96.8
SEAL - Professional Reasoning Benchmark - Legal52.29Score96.4
Chatbot Arena (Vision)1294Arena Score96.3
Vals AI Finance Agent60.59Accuracy (%)96

Interactive version: theaggregate.ai/model?slug=muse-spark · How the rankings work · Data refreshed daily, snapshot 2026-07-22.