AGI-Eval Community - Objective Accuracy: leaderboard

Metric: Accuracy (%). Source: agi-eval.cn. 141 models tracked.

Top models

#ModelScore
1GPT-5.586.14
2Claude Fable 585.21
3Gemini 3.1 Pro (Preview)84.05
4Kimi K383.73
5Gemini 3.5 Flash82.82
6Seed 2.1 Pro82.56
7Claude Opus 4.881.78
8GPT-5.481.62
9Qwen 3.7 Max81.61
10Seed 2.0 Pro81.42
11DeepSeek V4 Pro (Max)81.3
12Kimi K2.681.21
13Claude Opus 4.680.71
14Claude Sonnet 580.42
15GLM-5.280.41

Interactive version: theaggregate.ai/benchmark?slug=agi-eval-community-objective-accuracy · How It Works · Data refreshed daily, snapshot 2026-09-19.