OpenCompass LLM - Average - English (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-5 (Thinking)72.1
2O3 (2025-04-16) (High)71.1
3GLM-4.671
4Qwen 3 235B A22B 2507 (Thinking)69.7
5O4 Mini (2025-04-16) (High)69.7
6Claude Sonnet 4.5 (Thinking)69.5
7DeepSeek R1 052869.3
8GPT-OSS-120B (High)68.1
9Grok 467.8
10Qwen 3 Next 80B A3B (Thinking)66.9
11Gemini 2.5 Pro66.5
12Claude Haiku 4.5 (Thinking)65.5
13Seed-OSS-36B-Instruct65.1
14Hunyuan-T1-2025082264.3
15DeepSeek V3.2 Exp63.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-english-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.