OpenCompass LLM - Language - Chinese (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1Yi Lightning66.1
2GPT-4o (2024-11-20)65.9
3GLM-4 Plus62.9
4O1 Mini (2024-09-12)61.7
5DeepSeek V2.560.8
6TeleChat260.5
7Grok Beta60
8Qwen 2.5 72B Instruct57.8
9Claude 3.5 Sonnet (20241022)55.3
10Step 2 16K55.1
11Mistral Large 2 (Nov) Instruct (2411)52.9
12360gpt2-pro51.5
13Yi 1.5 34B Chat50.1
14GPT-4o (2024-08-06)50
15Yi-1.5-9B Chat47.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-chinese-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.