OpenCompass LLM - Language - English (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1Yi Lightning61.2
2Grok Beta60.7
3GLM-4 Plus60.5
4O1 Mini (2024-09-12)60.3
5GPT-4o (2024-11-20)59.5
6TeleChat257.3
7DeepSeek V2.556.6
8Qwen 2.5 72B Instruct56.5
9Mistral Large 2 (Nov) Instruct (2411)55.3
10Step 2 16K55
11Yi 1.5 34B Chat53.7
12Llama 3.1 405B Instruct FP850.9
13Llama 3.1 70B Instruct50.4
14GPT-4o (2024-08-06)50
15Mistral-Small-Instruct-240950

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-english-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.