OpenCompass LLM - Average - English (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1O1 Mini (2024-09-12)73.2
2GPT-4o (2024-11-20)60.4
3Qwen 2.5 72B Instruct58.7
4GLM-4 Plus58.7
5Yi Lightning57.4
6Grok Beta57.1
7Claude 3.5 Sonnet (20241022)56.4
8Mistral Large 2 (Nov) Instruct (2411)55.7
9Llama 3.1 405B Instruct FP855.1
10GPT-4o (2024-08-06)54.5
11DeepSeek V2.554.5
12360gpt2-pro53.7
13Step 2 16K53.6
14TeleChat253
15Llama 3.1 70B Instruct48.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-english-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.