Muse Spark 1.1 — benchmark results
Meta's Muse Spark 1.1 model, an updated release of the closed Muse Spark system. Provider: Meta. Released 2026-07-09. Access: Private.
Unified ELO 1886 ± 18, rank #72 of 1776 rated models, from 67 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LLM Stats (MCP Atlas) | 88.1 | Score (%) | 100 |
| LLM Stats (Toolathlon) | 75.6 | Score (%) | 100 |
| SEAL - MCP Atlas | 88.1 | Score | 100 |
| SEAL - MultiNRC | 65.59 | Score | 100 |
| SEAL - Professional Reasoning Benchmark - Finance | 55.01 | Score | 100 |
| SEAL - Professional Reasoning Benchmark - Legal | 57.05 | Score | 100 |
| SEAL - SWE-Bench Pro (Private Dataset) | 51.5 | Score | 100 |
| SEAL - SWE-Bench Pro (Public Dataset) | 61.5 | Score | 100 |
| SEAL - VisualToolBench (VTB) | 44.77 | Score | 100 |
| Vals AI Harvey Legal Agent Bench | 20 | Accuracy (%) | 100 |
| Vals AI MedScribe | 88.89 | Accuracy (%) | 100 |
| Vals AI TaxEval v2 | 79.72 | Accuracy (%) | 100 |
Interactive version: theaggregate.ai/model?slug=muse-spark-1-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.