OpenCompass LLM - Average - Chinese (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1O1 Mini (2024-09-12)70.5
2GPT-4o (2024-11-20)62.4
3GLM-4 Plus58.3
4Yi Lightning57.5
5Claude 3.5 Sonnet (20241022)56.8
6Qwen 2.5 72B Instruct55.9
7DeepSeek V2.554.6
8360gpt2-pro53.7
9GPT-4o (2024-08-06)53.3
10Mistral Large 2 (Nov) Instruct (2411)53.2
11Grok Beta52.9
12Step 2 16K52.3
13TeleChat252.1
14Llama 3.1 405B Instruct FP847.3
15Qwen 2.5 7B Instruct42.2

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-chinese-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.