Horangi 4 - GLP - Mathematical Reasoning: leaderboard

Metric: Score (%). Source: horangi.ai. 105 models tracked.

Top models

#ModelScore
1Claude Fable 5 (High)98.5
2Grok 4.2098
3GPT-5.4 Nano (xHigh)98
4GPT-5.4 (xHigh)97.5
5Claude Opus 4.8 (High)97.5
6Grok 4.597.47
7GPT-5.2 (xHigh)97
8Qwen 3.7 Max96.83
9GPT-5.5 (xHigh)96.5
10Gemini 3 Flash (Preview)96.33
11GPT-5.4 Mini (xHigh)96.33
12Gemini 3 Pro (Preview) (High)96.33
13A.X-K1 (Thinking)96
14DeepSeek V3.2 (High)95.89
15Gemini 3.1 Pro (Preview) (High)95.83

Interactive version: theaggregate.ai/benchmark?slug=horangi-4-glp-mathematical-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.