OpenCompass Reasoning - Common - English (CompassBench 2507): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 19 models tracked.

Top models

#ModelScore
1Claude Sonnet 4 (Thinking)76.7
2Qwen 3 235B A22B 2507 Instruct75.6
3Hunyuan-T1-2025071175.6
4Doubao-Seed-1.6-thinking-25071574.4
5GPT-573.3
6GLM-4.573.3
7GPT-4.1 (2025-04-14)70.9
8Kimi K269.8
9GLM 4.5 Air68.6
10MiniMax M1 80k68.6
11ERNIE-X1-Turbo-32K68.6
12DeepSeek V3 (0324)66.3
13MiniMax-Text-0161.6

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-common-english-compassbench-2507 · How It Works · Data refreshed daily, snapshot 2026-09-19.