Muse Spark: benchmark results
Meta's Muse Spark model, a closed high-capability system tracked among the top ranked models. Provider: Meta. Released 2026-04-08. Access: Private.
Unified ELO 1722 ± 1, rank #30 of 1392 rated models, from 102 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LLM Stats (HealthBench Hard) | 42.8 | Score (%) | 100 |
| SEAL - MultiChallenge | 75.52 | Score | 100 |
| SEAL - TutorBench | 68.55 | Score | 100 |
| Chatbot Arena (Text - French) | 1525 | Arena Score | 99.6 |
| Chatbot Arena (Text - German) | 1509 | Arena Score | 99.3 |
| Chatbot Arena (Vision - Humor) | 1326 | Arena Score | 98.8 |
| Vals AI TaxEval v2 | 77.68 | Accuracy (%) | 98.6 |
| Chatbot Arena (Text - Korean) | 1474 | Arena Score | 98.5 |
| Vals AI AIME | 96.88 | Accuracy (%) | 98.4 |
| Chatbot Arena (Text - English) | 1496 | Arena Score | 97.6 |
| Chatbot Arena (Text) | 1488 | Elo | 96.9 |
| MedXpertQA | 78.4 | Score (self-reported) | 96.7 |
Interactive version: theaggregate.ai/model?slug=muse-spark · How It Works · Data refreshed daily, snapshot 2026-09-05.