SuperCLUE General (November 2025) - Science Reasoning: leaderboard

Metric: Score. Source: www.superclueai.com. 32 models tracked.

Top models

#ModelScore
1GPT-5.2 (High)56.76
2GPT-5.1 (High)53.98
3Qwen 3 Max46.02
4Grok 4 Fast (Reasoning)44.25
5Claude Opus 4.5 (Thinking)44.25
6Gemini 3 Pro (Preview)43.36
7DeepSeek V3.2 Speciale43.36
8DeepSeek V3.2 (Thinking)42.48
9Claude Sonnet 4.5 (Thinking)38.94
10Qwen 3 Max (Preview) (Thinking)38.94
11GLM-4.737.5
12Kimi K2 (Thinking)36.28
13GLM-4.636.28
14DeepSeek V3.2 Exp (Thinking)36.28
15O3 (High)34.51

Interactive version: theaggregate.ai/benchmark?slug=superclue-general-november-2025-science-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.