AGI-Eval Community - Objective Accuracy (English): leaderboard

Metric: Accuracy (%). Source: agi-eval.cn. 139 models tracked.

Top models

#ModelScore
1Claude Opus 4.891.58
2Claude Opus 4.691.56
3Gemini 3.1 Pro (Preview)91.54
4Gemini 3.5 Flash91.42
5Seed 2.0 Pro91.19
6Claude Fable 591.11
7Kimi K2.690.99
8Gemini 3 Flash (Preview)90.78
9Kimi K390.74
10Qwen 3.7 Max90.68
11GPT-5.590.65
12Seed 2.1 Pro90.63
13Gemini 3 Pro (Preview)90.61
14Kimi K2.5 (Thinking)90.57
15GLM-5.290.29

Interactive version: theaggregate.ai/benchmark?slug=agi-eval-community-objective-accuracy-english · How It Works · Data refreshed daily, snapshot 2026-09-19.