The Aggregate: unified LLM rankings, daily

We fold every public benchmark we can find into one daily ranking. Unified rankings for 1761 AI models across 5615 public benchmarks, aggregated from public leaderboards and refreshed daily. Rankings use an Item Response Theory (IRT) fit that maps every model onto one ELO scale.

Top models by unified ELO

RankModelProviderUnified ELOBenchmarks
1Claude Fable 5.1Anthropic1808 ± 1157
2GPT-6OpenAI1805 ± 1100
3Claude Mythos 5Anthropic1800 ± 154
4Gemini 3.8 FlashGoogle1778 ± 1146
5Gemini 3.7 FlashGoogle1774 ± 1267
6Claude Fable 5Anthropic1773 ± 1412
7GPT-5.5 ProOpenAI1773 ± 155
8GPT-5.6 Pro SolOpenAI1772 ± 118
9Claude Opus 5Anthropic1771 ± 1393
10Muse Spark 1.3Meta1770 ± 183
11Claude Mythos PreviewAnthropic1767 ± 179
12GPT-5.6 SolOpenAI1761 ± 1516
13Kimi K3Moonshot1754 ± 1403
14GPT-5.4 ProOpenAI1753 ± 162
15GPT-5.5OpenAI1743 ± 11080
16Gemini 3 Deep ThinkGoogle1742 ± 121
17Grok 4.6xAI1741 ± 1226
18Gemini 3.6 FlashGoogle1737 ± 1299
19Muse Spark 1.2Meta1737 ± 1161
20Qwen 3.8 MaxAlibaba1735 ± 1228

Latest leaderboard changes

Explore: all models · benchmark catalog · capability trends · daily changes

Interactive version: theaggregate.ai/ · How It Works · Data refreshed daily, snapshot 2026-09-05.