AGI-Eval Community - Learning (English): leaderboard

Metric: Accuracy (%). Source: agi-eval.cn. 139 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)97.52
2Gemini 3 Flash (Preview)97.31
3Qwen 3.7 Max96.94
4GPT-5.496.72
5Seed 2.0 Pro96.54
6Kimi K2.696.41
7Kimi K396.41
8GLM-5.296.38
9Gemini 3.5 Flash96.34
10GLM-5.196.09
11GPT-5.596
12DeepSeek V4 Pro (Max)95.91
13Gemini 3 Pro (Preview)95.77
14GPT-5.195.56
15Qwen 3.5 397B A17B (Thinking)95.38

Interactive version: theaggregate.ai/benchmark?slug=agi-eval-community-learning-english · How It Works · Data refreshed daily, snapshot 2026-09-19.