Muse Glimmer 30B: benchmark results

Provider: Meta. Released 2026-08-09. Access: Open.

Unified ELO 1656 ± 1, rank #118 of 1392 rated models, from 92 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - ALT - Controllability93.09Score (%)95.1
Nejumi 4 - GLP - Logical Reasoning95Score (%)95.1
Conceptual Reasoning Index - Consistency (ACCoRD)72.05Chance-Corrected Score (0-100)85.8
Chatbot Arena (Text - Math)1453Arena Score84.2
LLM Stats (Tau3 Banking)23.5Score (%)83.3
AI Chess Leaderboard (Reasoning)1132Elo82.7
Nejumi 4 - MT-Bench (Japanese)97.12Score (%)81.6
BenchmarkList ECI133.24Capability Index (ECI)79.4
Chatbot Arena (Text - Chinese)1479Arena Score78.9
SpeechMap Compliance80.1% Requests Completed78.1
Chatbot Arena (Text - Coding)1482Arena Score76.9
AI for Education Pedagogy - Social studies84.55Accuracy (%)76.7

Interactive version: theaggregate.ai/model?slug=muse-glimmer-30b · How It Works · Data refreshed daily, snapshot 2026-09-05.