OpenCompass Reasoning - Inductive - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1GPT-4 Turbo47.8
2Qwen 1.5 14B Chat37.4
3Qwen 1.5 72B Chat35.7
4GPT-4o (2024-05-13)34.2
5GLM-433.5
6Qwen 1.5 110B Chat33
7Qwen 1.5 32B Chat32.4
8internlm2-chat-7B32.4
9Yi-1.5-9B Chat31.9
10Yi 1.5 34B Chat31.9
11Claude 3 Opus30.4
12Mistral Large30.2
13Qwen 1.5 7B Chat29.7
14Yi-1.5-6B-Chat29.7
15Yi Large29.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-inductive-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.