OpenCompass LLM - Language - Chinese (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-5 (Thinking)89.3
2Qwen 3 235B A22B 2507 (Thinking)89.1
3GPT-OSS-120B (High)89.1
4O3 (2025-04-16) (High)88.5
5Hunyuan-T1-2025082286.5
6Grok 485.7
7O4 Mini (2025-04-16) (High)85
8Nanbeige3.5-Pro (Thinking)84.7
9DeepSeek R1 052884.5
10Gemini 2.5 Pro84.4
11GLM-4.682.9
12Ling-1T82.5
13Seed-OSS-36B-Instruct82.4
14Claude Sonnet 4.5 (Thinking)81.4
15DeepSeek V3.2 Exp81.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-chinese-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.