OpenCompass LLM - Instruction Following (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1O1 Mini (2024-09-12)75
2GPT-4o (2024-11-20)71
3Yi Lightning64.7
4Qwen 2.5 72B Instruct62
5GLM-4 Plus59.5
6TeleChat256.5
7Grok Beta56.2
8Step 2 16K56
9DeepSeek V2.555.8
10360gpt2-pro52.9
11Mistral Large 2 (Nov) Instruct (2411)52.7
12Claude 3.5 Sonnet (20241022)50.4
13GPT-4o (2024-08-06)50
14Llama 3.1 405B Instruct FP847.3
15Mistral-Small-Instruct-240946.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-instruction-following-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.