AlphaMonarch-7B: benchmark results

Provider: Other. Released 2024-03-01. Access: Open.

Unified ELO 1432 ± 1, rank #1023 of 1392 rated models, from 31 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC62.69Accuracy (%)92.3
Open Korean LLM Leaderboard43.46Average Score (%)86.7
Open CoT - LSAT Analytical Reasoning5.22CoT Gain (%)68.3
Open LLM Leaderboard - IFEval49.39Score57.9
Open Chinese LLM - ARC Challenge53.58Accuracy (%)57.6
Open Medical LLM - MMLU College Medicine63.58Accuracy (%)56.5
Open Chinese LLM - HellaSwag60.55Accuracy (%)53.7
Open Medical LLM - MMLU Anatomy60.74Accuracy (%)52.6
Open Chinese LLM - GSM8K45.26Accuracy (%)48.1
Open LLM Leaderboard - MuSR9.32Score45.1
Open Chinese LLM Leaderboard55.95Average Score (%)42.9
Open Medical LLM - PubMedQA73.2Accuracy (%)40.6

Interactive version: theaggregate.ai/model?slug=alphamonarch-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.