Muse Spark: benchmark results

Meta's Muse Spark model, a closed high-capability system tracked among the top ranked models. Provider: Meta. Released 2026-04-08. Access: Private.

Unified ELO 1722 ± 1, rank #30 of 1392 rated models, from 102 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM Stats (HealthBench Hard)42.8Score (%)100
SEAL - MultiChallenge75.52Score100
SEAL - TutorBench68.55Score100
Chatbot Arena (Text - French)1525Arena Score99.6
Chatbot Arena (Text - German)1509Arena Score99.3
Chatbot Arena (Vision - Humor)1326Arena Score98.8
Vals AI TaxEval v277.68Accuracy (%)98.6
Chatbot Arena (Text - Korean)1474Arena Score98.5
Vals AI AIME96.88Accuracy (%)98.4
Chatbot Arena (Text - English)1496Arena Score97.6
Chatbot Arena (Text)1488Elo96.9
MedXpertQA78.4Score (self-reported)96.7

Interactive version: theaggregate.ai/model?slug=muse-spark · How It Works · Data refreshed daily, snapshot 2026-09-05.