OpenCompass Subjective - Reasoning (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1GPT-4o (2024-05-13)61.6
2GPT-4 Turbo56.9
3Claude 3 Opus56.5
4DeepSeek V2 Chat49
5Yi Large47.4
6GLM-447
7Mistral Large44.1
8Qwen 1.5 110B Chat43.3
9Llama 3 70B Instruct42.7
10Moonshot v1 8K42.4
11Qwen 1.5 72B Chat40.4
12Qwen 1.5 32B Chat36.9
13Mixtral 8x22B Instruct (v0.1)35.8
14Yi 1.5 34B Chat34.7
15Qwen 1.5 14B Chat34.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-subjective-reasoning-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.