OpenCompass LLM - Knowledge - English (CompassBench 2504): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 28 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini93.5
2GPT-4.1 (2025-04-14)93.2
3Gemini 2.5 Pro (Preview 05-06)92.2
4Step 2 16K92
5O4 Mini (High)91.8
6DeepSeek R191.5
7Llama 4 Maverick Instruct91
8Grok 390.8
9ERNIE-X1-Turbo-32K90.8
10Claude 3.7 Sonnet (Thinking)89.8
11MiniMax-Text-0189.2
12DeepSeek V3 (0324)88.8
13O3 Mini (High)88.8
14Qwen 3 235B A22B (Thinking)88
15Qwen 3 235B A22B87.2

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-english-compassbench-2504 · How It Works · Data refreshed daily, snapshot 2026-09-19.