OpenCompass Language - Creation - English (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-11-20)59.3
2O1 Mini (2024-09-12)57.2
3GLM-4 Plus54.8
4Yi Lightning54.5
5Grok Beta53.8
6Qwen 2.5 72B Instruct52
7Mistral Large 2 (Nov) Instruct (2411)50.8
8TeleChat250.3
9DeepSeek V2.550.1
10GPT-4o (2024-08-06)50
11Claude 3.5 Sonnet (20241022)49.3
12Yi 1.5 34B Chat48.4
13360gpt2-pro48.2
14Mistral-Small-Instruct-240948.1
15Step 2 16K46.9

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-creation-english-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.