OpenCompass LLM - Average (CompassBench 2601): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 26 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview)76.5
2Qwen 3 Max (2026-01-23)74.4
3Claude Opus 4.5 (Thinking)74.2
4Kimi K2.573.3
5GPT-5.2 (High)73.1
6GLM-4.772.8
7Kimi K2 (Thinking)71.1
8DeepSeek V3.270.8
9Claude Sonnet 4.5 (Thinking)69.4
10Tencent HY 2.0 Think69.1
11Grok 4.168.7
12GPT-OSS-120B (High)67.4
13O3 (2025-04-16) (High)66.6
14ERNIE 5.065
15Qwen 3 235B A22B 2507 (Thinking)64.9

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-compassbench-2601 · How It Works · Data refreshed daily, snapshot 2026-09-19.