OpenCompass LLM - Instruction Following - Chinese (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-11-20)74.2
2O1 Mini (2024-09-12)74
3Yi Lightning65.5
4GLM-4 Plus61.7
5Qwen 2.5 72B Instruct59.8
6TeleChat257.9
7Step 2 16K56.5
8Grok Beta55.7
9DeepSeek V2.554.2
10360gpt2-pro54.1
11Mistral Large 2 (Nov) Instruct (2411)52.3
12Claude 3.5 Sonnet (20241022)50.6
13GPT-4o (2024-08-06)50
14Gemma 2 27B (IT)47.3
15Mistral-Small-Instruct-240943.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-instruction-following-chinese-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.