OpenEval - Omni-MATH — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 41 models tracked.

Top models

#ModelScore
1Gemma 3 27B (IT)40.01
2Qwen 3 4B Instruct38.47
3Gemma 3 12B (IT)35.84
4Qwen 2.5 32B Instruct33.53
5Qwen 2.5 72B Instruct31.93
6Qwen 2.5 14B Instruct30
7Qwen 2.5 7B Instruct28.08
8Qwen 2 72B Instruct23.26
9Qwen 2.5 3B Instruct20.52
10Qwen 2.5 1.5B Instruct15.82
11Gemma 2 27B (IT)14.55
12Qwen 1.5 32B Chat14.31
13Qwen 2 7B Instruct13.81
14Qwen 1.5 14B Chat12.05
15Qwen 1.5 7B Chat9.54

Interactive version: theaggregate.ai/benchmark?slug=openeval-omni-math · How the rankings work · Data refreshed daily, snapshot 2026-07-22.