OpenCompass Language - Dialogue - English (CompassBench 2501): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 40 models tracked.

Top models

#ModelScore
1DeepSeek R179.5
2MiniMax-Text-0172.6
3Qwen 2.5 Max71.2
4Gemini 2.0 Pro (Preview 02-05)70.6
5DeepSeek V369.2
6GPT-4o (2024-11-20)68.8
7Yi Lightning67.2
8O1 Mini (2024-09-12)67.1
9InternLM3-8B-Instruct63.3
10Qwen 2.5 72B Instruct61.9
11O3 Mini (2025-01-31)61.9
12O1 (2024-12-17)61.3
13Claude 3.5 Sonnet (20241022)60.2
14Mistral Large 2 (Nov) Instruct (2411)59.9
15GLM-4 Plus59.2

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-dialogue-english-compassbench-2501 · How It Works · Data refreshed daily, snapshot 2026-09-19.