Muse Spark — benchmark results
Meta's Muse Spark model, a closed high-capability system tracked among the top ranked models. Provider: Meta. Released 2026-04-08. Access: Private.
Unified ELO 1871 ± 16, rank #86 of 1776 rated models, from 103 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LLM Stats (HealthBench Hard) | 42.8 | Score (%) | 100 |
| LLM Stats (MedXpertQA) | 78.4 | Score (%) | 100 |
| SEAL - MultiChallenge | 75.52 | Score | 100 |
| SEAL - TutorBench | 68.55 | Score | 100 |
| TutorBench | 68.55 | Score (self-reported) | 100 |
| Vals AI TaxEval v2 | 77.68 | Accuracy (%) | 99.2 |
| Chatbot Arena (Text) | 1488 | Elo | 98.4 |
| Vals AI AIME | 96.88 | Accuracy (%) | 98.4 |
| AA Humanity's Last Exam | 39.94 | Accuracy (%) | 96.8 |
| SEAL - Professional Reasoning Benchmark - Legal | 52.29 | Score | 96.4 |
| Chatbot Arena (Vision) | 1294 | Arena Score | 96.3 |
| Vals AI Finance Agent | 60.59 | Accuracy (%) | 96 |
Interactive version: theaggregate.ai/model?slug=muse-spark · How the rankings work · Data refreshed daily, snapshot 2026-07-22.