OpenEval - Omni-MATH: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 22 models tracked.

Top models

#ModelScore
1Qwen 3 4B Instruct38.53
2Qwen 2.5 32B Instruct33.5
3Qwen 2.5 72B Instruct31.9
4Qwen 2.5 14B Instruct29.97
5Qwen 2.5 7B Instruct Turbo29.4
6Qwen 2.5 7B Instruct28.05
7Qwen 2 72B Instruct23.23
8Qwen 2.5 3B Instruct20.6
9Qwen 2.5 1.5B Instruct15.8
10Qwen 1.5 32B Chat14.3
11Qwen 2 7B Instruct13.8
12Qwen 1.5 14B Chat12.03
13Qwen 1.5 7B Chat9.53
14Qwen 2.5 0.5B Instruct9.43
15Qwen-14B-Chat7.72

Interactive version: theaggregate.ai/benchmark?slug=openeval-omni-math · How It Works · Data refreshed daily, snapshot 2026-09-05.