OpenCompass Language - Instruction Following (CompassBench 2601): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 26 models tracked.

Top models

#ModelScore
1ERNIE 5.078.5
2Qwen 3 Max (2026-01-23)77.7
3Gemini 3 Pro (Preview)76.4
4O4 Mini (2025-04-16) (High)76.2
5Kimi K2 (Thinking)74.6
6Kimi K2.574.5
7GLM-4.774
8GPT-5.2 (High)73.9
9O3 (2025-04-16) (High)73.8
10GPT-OSS-120B (High)73.2
11Qwen 3 Next 80B A3B (Thinking)71.4
12DeepSeek V3.271.4
13Tencent HY 2.0 Think69.4
14MiniMax-M2.168.3
15Claude Opus 4.5 (Thinking)66.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-instruction-following-compassbench-2601 · How It Works · Data refreshed daily, snapshot 2026-09-19.