NuminaMath-7B-CoT — benchmark results

Provider: Other. Released 2024-07-15. Access: Open.

Unified ELO 1219 ± 69, rank #1666 of 1776 rated models, from 8 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 526.96Score79.4
Open Korean LLM Leaderboard38.3Average Score (%)43
Open LLM Leaderboard - MMLU-Pro20.76Score32.6
Open LLM Leaderboard - BBH19.15Score28.6
Open LLM Leaderboard - IFEval26.89Score23.9
Open LLM Leaderboard - GPQA2.13Score20.3
MATH-Perturb (Hard)17.2Accuracy (%)19.4
Open LLM Leaderboard - MuSR0.83Score1.1

Interactive version: theaggregate.ai/model?slug=numinamath-7b-cot · How the rankings work · Data refreshed daily, snapshot 2026-07-22.