OpenCompass Language - Dialogue - Chinese (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro96.1
2O3 (2025-04-16) (High)95.9
3GPT-5 (Thinking)95.9
4Qwen 3 235B A22B 2507 (Thinking)95.5
5GLM-4.694.6
6Hunyuan-T1-2025082294.6
7O4 Mini (2025-04-16) (High)94.3
8Grok 493.7
9GPT-OSS-120B (High)93.3
10Seed-OSS-36B-Instruct93.2
11Nanbeige3.5-Pro (Thinking)92.8
12Kimi K2 090591.7
13DeepSeek R1 052891.4
14Ling-1T90.1
15Gemma 3 27B (IT)89.2

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-dialogue-chinese-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.