OpenCompass Language - Creation - Chinese (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-11-20)66.1
2O1 Mini (2024-09-12)64.1
3Yi Lightning62.9
4DeepSeek V2.560.3
5TeleChat259.2
6GLM-4 Plus57
7Claude 3.5 Sonnet (20241022)56.4
8Grok Beta55.5
9Qwen 2.5 72B Instruct54.6
10360gpt2-pro53.8
11Mistral Large 2 (Nov) Instruct (2411)50.2
12GPT-4o (2024-08-06)50
13Step 2 16K50
14Yi 1.5 34B Chat49
15Yi-1.5-9B Chat46.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-creation-chinese-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.