OpenCompass Language - Creation - Chinese (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-5 (Thinking)94.7
2O3 (2025-04-16) (High)93.7
3Qwen 3 235B A22B 2507 (Thinking)92.4
4GPT-OSS-120B (High)91.6
5Hunyuan-T1-2025082291.3
6Grok 490
7O4 Mini (2025-04-16) (High)89.9
8Claude Sonnet 4.5 (Thinking)88.2
9Nanbeige3.5-Pro (Thinking)88.2
10DeepSeek R1 052888.1
11Gemini 2.5 Pro87.5
12DeepSeek V3.2 Exp86.7
13GLM-4.686.6
14Seed-OSS-36B-Instruct86.4
15Ling-1T85.3

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-creation-chinese-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.