OpenCompass LLM - Language - English (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1O3 (2025-04-16) (High)89.7
2GPT-OSS-120B (High)89.5
3GPT-5 (Thinking)89.2
4Qwen 3 235B A22B 2507 (Thinking)87.8
5O4 Mini (2025-04-16) (High)87.6
6Grok 487.2
7DeepSeek R1 052882.7
8Gemini 2.5 Pro82.6
9Kimi K2 090581.5
10Seed-OSS-36B-Instruct81.4
11Qwen 3 Next 80B A3B (Thinking)81.3
12GLM-4.680.4
13Nanbeige3.5-Pro (Thinking)80.4
14DeepSeek V3.2 Exp80.3
15Ling-1T80

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-english-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.