NuminaMath-7B-CoT: benchmark results

Provider: Other. Released 2024-07-15. Access: Open.

Unified ELO 1342 ± 1, rank #1283 of 1392 rated models, from 8 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 526.96Score79.4
Open LLM Leaderboard - MMLU-Pro20.76Score32.6
Open LLM Leaderboard - BBH19.15Score28.7
Open LLM Leaderboard - IFEval26.89Score23.9
Open Korean LLM Leaderboard32.02Average Score (%)21.9
Open LLM Leaderboard - GPQA2.13Score20.3
MATH-Perturb (Hard)17.2Accuracy (%)19.4
Open LLM Leaderboard - MuSR0.83Score1.1

Interactive version: theaggregate.ai/model?slug=numinamath-7b-cot · How It Works · Data refreshed daily, snapshot 2026-09-05.