AGI-Eval Community - Subject Knowledge: leaderboard

Metric: Accuracy (%). Source: agi-eval.cn. 141 models tracked.

Top models

#ModelScore
1Seed 2.0 Pro91.1
2Qwen 3.7 Max90.83
3Seed 2.1 Pro90.75
4Gemini 3.1 Pro (Preview)90.32
5Gemini 3.5 Flash90.25
6Claude Fable 589.75
7Kimi K2.689.59
8DeepSeek V4 Pro (Max)89.52
9Gemini 3 Pro (Preview)89.51
10GPT-5.589.41
11GLM-5.289.32
12GLM-5.189.17
13Kimi K2.5 (Thinking)88.86
14Kimi K388.82
15Seed 1.888.57

Interactive version: theaggregate.ai/benchmark?slug=agi-eval-community-subject-knowledge · How It Works · Data refreshed daily, snapshot 2026-09-19.