Nejumi 4 - GLP - Reasoning: leaderboard

Metric: Score (%). Source: nejumi.ai. 126 models tracked.

Top models

#ModelScore
1Claude Opus 596.56
2Claude Fable 596.33
3GPT-5.6 Terra94.33
4Qwen3.8 2.4T A95B94.11
5GPT-5.6 Sol92.78
6Claude Opus 4.891.67
7Gemini 3.6 Flash91.61
8Gemini 3.1 Pro (Preview)91.28
9Claude Opus 4.790.94
10Claude Opus 4.690.78
11GPT-5.590.44
12GPT-5.4 (2026-03-05)89.94
13Hy4 preview89.28
14Inkling Small89.22
15Kimi K389.11

Interactive version: theaggregate.ai/benchmark?slug=nejumi-4-glp-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.