AGI-Eval Community - Learning: leaderboard

Metric: Accuracy (%). Source: agi-eval.cn. 141 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)94.78
2Gemini 3 Flash (Preview)93.89
3Gemini 3.5 Flash92.41
4Gemini 3 Pro (Preview)92.27
5GLM-5.192.26
6Qwen 3.7 Max92.03
7GPT-5.591.89
8GLM-5.291.86
9DeepSeek V4 Pro (Max)91.55
10GLM-591.4
11Claude Opus 4.691.22
12Claude Opus 4.891.13
13GLM-4.791.02
14Qwen 3.5 397B A17B (Thinking)90.99
15Kimi K390.9

Interactive version: theaggregate.ai/benchmark?slug=agi-eval-community-learning · How It Works · Data refreshed daily, snapshot 2026-09-19.