Horangi 4 - GLP - Logical Reasoning: leaderboard

Metric: Score (%). Source: horangi.ai. 105 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview) (High)90.5
2Qwen 3.7 Plus90.11
3Claude Opus 4.1 (20250805)89.5
4Claude Sonnet 4.5 (High)89.5
5Claude Opus 4.5 (20251101) (High)89.5
6Qwen 3.7 Max89.17
7Claude Opus 4.6 (High)89
8GPT-5.188.5
9Qwen 3.5 27B87.5
10Gemini 3.5 Flash87.5
11Gemini 3 Flash (Preview)87.5
12GPT-5.4 (xHigh)87.5
13GLM-5.2 (High)87.5
14Kimi K2.587
15Claude Opus 4.8 (High)87

Interactive version: theaggregate.ai/benchmark?slug=horangi-4-glp-logical-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.