OpenCompass LLM - Language (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1Yi Lightning63.7
2GPT-4o (2024-11-20)62.7
3GLM-4 Plus61.7
4O1 Mini (2024-09-12)61
5Grok Beta60.3
6TeleChat258.9
7DeepSeek V2.558.7
8Qwen 2.5 72B Instruct57.1
9Step 2 16K55.1
10Mistral Large 2 (Nov) Instruct (2411)54.1
11Yi 1.5 34B Chat51.9
12360gpt2-pro50.7
13GPT-4o (2024-08-06)50
14Claude 3.5 Sonnet (20241022)49.2
15Llama 3.1 405B Instruct FP847.5

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.