OpenCompass LLM - Knowledge (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-5 (Thinking)90.9
2O3 (2025-04-16) (High)90.1
3Grok 489.8
4DeepSeek R1 052889.6
5DeepSeek V3.2 Exp89.5
6Gemini 2.5 Pro89.2
7Ling-1T89.1
8Kimi K2 090589
9Qwen 3 235B A22B 2507 (Thinking)88.9
10Claude Sonnet 4.5 (Thinking)88.4
11Llama 4 Maverick Instruct87.9
12GLM-4.687.1
13O4 Mini (2025-04-16) (High)86.9
14Hunyuan-T1-2025082286.8
15Qwen 3 Next 80B A3B (Thinking)84.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.