Monarch-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1526 ± 23, rank #1007 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC277.35MC2 (%) (0-shot)96.9
Open LLM Leaderboard v1 - HellaSwag89.03Normalized accuracy (%) (10-shot)96.1
Open LLM Leaderboard v1 - ARC Challenge73.04Normalized accuracy (%) (25-shot)95.2
YALL Nous Leaderboard57.56Average94.9
Open LLM Leaderboard v1 - WinoGrande84.61Accuracy (%) (5-shot)94.1
Open LLM Leaderboard v1 - GSM8K69.07Accuracy (%) (5-shot)87.9
Open Portuguese LLM - ASSIN2 RTE92.4Macro F1 (%)78.7
Open Portuguese LLM - FaQuAD NLI76.57Macro F1 (%)76.8
Open LLM Leaderboard v1 - MMLU64.41Accuracy (%) (5-shot)69.9
Open Portuguese LLM - BLUEX52.57Accuracy (%)53.3
Open Portuguese LLM - ENEM62.28Accuracy (%)51.2
Open Portuguese LLM - OAB Exams42Accuracy (%)50.2

Interactive version: theaggregate.ai/model?slug=monarch-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.