OpenCompass Language - Intention Recognition - English (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1Llama 3 70B Instruct83.7
2GPT-4o (2024-05-13)83.7
3Qwen 1.5 32B Chat82.7
4Yi Large79.3
5GPT-4 Turbo79
6Qwen 1.5 110B Chat79
7GLM-478.7
8Claude 3 Opus78.3
9Qwen 1.5 72B Chat78
10Yi 1.5 34B Chat77.7
11Qwen 1.5 14B Chat77
12internlm2-chat-20B76
13Command-R+75.3
14internlm2-chat-7B73.7
15Mistral Large70.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-intention-recognition-english-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.