SuperCLUE General (2025 Annual) - Science Reasoning: leaderboard

Metric: Score. Source: www.superclueai.com. 34 models tracked.

Top models

#ModelScore
1Claude Opus 4.678.63
2Gemini 3.1 Pro (Preview) (High)77.05
3GPT-5.2 (High)75.21
4Doubao-Seed-2.0-Pro-26021575.21
5Qwen 3.5 122B A10B (Thinking)74.59
6Gemini 3 Flash (Preview)74.17
7Gemini 3 Pro (Preview)73.77
8Claude Opus 4.5 (Thinking)73.77
9Qwen 3.5 397B A17B (Thinking)73.77
10Qwen 3.5 27B (Thinking)72.13
11DeepSeek V3.2 (Thinking)71.31
12Qwen 3 Max (Thinking)68.85
13Grok 468.03
14GLM-567.21
15Kimi K2.5 (Thinking)67.21

Interactive version: theaggregate.ai/benchmark?slug=superclue-general-2025-annual-science-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.