Model Leaderboard

1761 models tracked; 1389 have enough benchmark coverage for a unified ELO rating. Top 100 shown below.

RankModelProviderUnified ELOBenchmarks
1Claude Fable 5.1Anthropic1808 ± 1157
2GPT-6OpenAI1805 ± 1100
3Claude Mythos 5Anthropic1800 ± 154
4Gemini 3.8 FlashGoogle1778 ± 1146
5Gemini 3.7 FlashGoogle1774 ± 1267
6Claude Fable 5Anthropic1773 ± 1412
7GPT-5.5 ProOpenAI1773 ± 155
8GPT-5.6 Pro SolOpenAI1772 ± 118
9Claude Opus 5Anthropic1771 ± 1393
10Muse Spark 1.3Meta1770 ± 183
11Claude Mythos PreviewAnthropic1767 ± 179
12GPT-5.6 SolOpenAI1761 ± 1516
13Kimi K3Moonshot1754 ± 1403
14GPT-5.4 ProOpenAI1753 ± 162
15GPT-5.5OpenAI1743 ± 11080
16Gemini 3 Deep ThinkGoogle1742 ± 121
17Grok 4.6xAI1741 ± 1226
18Gemini 3.6 FlashGoogle1737 ± 1299
19Muse Spark 1.2Meta1737 ± 1161
20Qwen 3.8 MaxAlibaba1735 ± 1228
21Gemini 3.1 Pro (Preview)Google1734 ± 11142
22Muse Spark 1.1Meta1733 ± 1186
23Qwen 3.8 FlashAlibaba1731 ± 131
24Qwen 3.7 MaxAlibaba1729 ± 1248
25Hy4 previewOther1728 ± 178
26Gemini 3.5 FlashGoogle1726 ± 1424
27Qwen3.8-Flash-NextAlibaba1723 ± 1105
28Muse SparkMeta1722 ± 1103
29GPT-5.6 TerraOpenAI1719 ± 1372
30Qwen3.8 2.4T A95BAlibaba1719 ± 181
31Claude Opus 4.8Anthropic1718 ± 1826
32Gemini 3 ProGoogle1716 ± 1302
33Grok 4.5xAI1715 ± 1295
34GLM-5.3Zhipu1715 ± 1220
35Doubao-Seed-2.0-Pro-260215ByteDance1715 ± 18
36GPT-5.2 ProOpenAI1713 ± 167
37Gemini 2.5 Pro (Preview)Google1713 ± 19
38Seed 2.1 ProByteDance1712 ± 163
39Composer 2.5Other1712 ± 19
40DeepSeek V4 Pro (0813)DeepSeek1711 ± 1149
41Qwen 3.7 Max (2026-06-08)Alibaba1710 ± 17
42Claude Opus 4.7Anthropic1709 ± 1909
43Gemini 3 Pro (Preview)Google1709 ± 1626
44DeepSeek-V4-Flash-Vision-ExpDeepSeek1706 ± 139
45GPT-5.4OpenAI1704 ± 11017
46GLM-5.3 FlashZhipu1704 ± 1192
47Grok 4.20 Multi-AgentxAI1704 ± 141
48GLM-5.1 FP8Zhipu1704 ± 115
49Qwen 3.6 Max PreviewAlibaba1703 ± 1146
50Claude Opus 4.6Anthropic1699 ± 1874
51GPT-5.3 CodexOpenAI1699 ± 1134
52Gemini 3 FlashGoogle1698 ± 1333
53GPT-5.4 (2026-03-05)OpenAI1697 ± 149
54GPT-5 ProOpenAI1697 ± 138
55O3 Pro (2025-06-10)OpenAI1697 ± 17
56Seed 2.1 TurboByteDance1696 ± 139
57Gemini 3 Flash (Preview)Google1695 ± 1569
58Kimi K2.7 CodeMoonshot1695 ± 1141
59DeepSeek V4 Flash (0731)DeepSeek1692 ± 1174
60Ernie 5.1Baidu1692 ± 137
61GLM-5.2Zhipu1691 ± 1398
62Hy3Tencent1691 ± 1142
63GPT-5OpenAI1690 ± 11473
64GPT-5.6 LunaOpenAI1690 ± 1367
65GLM-5 FP8Zhipu1690 ± 132
66Claude Sonnet 5Anthropic1689 ± 1303
67Qwen 3.8 27BAlibaba1689 ± 1187
68GPT-5.2 CodexOpenAI1689 ± 187
69Qwen 3.7 PlusAlibaba1688 ± 1193
70Grok Build 0.1xAI1687 ± 166
71GPT-5.2 ChatGPTOpenAI1686 ± 19
72Kimi K2.6Moonshot1685 ± 1609
73Claude Opus 4.5Anthropic1685 ± 1470
74Qwen 3.6 MaxAlibaba1685 ± 111
75Gemini 2.5 Pro (Preview 06-05)Google1684 ± 142
76Gemma 4Google1684 ± 115
77Claude Opus 4.5 (20251101)Anthropic1683 ± 1108
78DeepSeek V4 Pro PreviewDeepSeek1683 ± 112
79GPT-5.2OpenAI1681 ± 11214
80Nex N2 ProNex AGI1681 ± 179
81Qwen 3.5 PlusAlibaba1680 ± 1114
82InklingThinking Machines1679 ± 1194
83Qwen3 235B A22B Instruct 2507 FP8Alibaba1679 ± 17
84GLM-5.1Zhipu1678 ± 1500
85GPT-5.1 Codex MaxOpenAI1676 ± 141
86O3 ProOpenAI1675 ± 135
87Doubao-1.8-ProByteDance1675 ± 121
88Seed 2.0 ProByteDance1674 ± 154
89O3OpenAI1672 ± 1403
90DeepSeek-V4-Flash-FP8DeepSeek1672 ± 115
91Qwen 3.6 PlusAlibaba1671 ± 1587
92MiMo-V2.5-ProXiaomi1671 ± 1250
93GPT-5 CodexOpenAI1671 ± 163
94Claude Sonnet 4.6Anthropic1670 ± 11243
95Qwen 3.5 397B A17BAlibaba1670 ± 1421
96NVIDIA-Nemotron-3-Super-120B-A12B-FP8NVIDIA1670 ± 112
97Inkling SmallThinking Machines1669 ± 1171
98GPT-5.1 CodexOpenAI1668 ± 184
99GPT-5.3OpenAI1667 ± 1281
100O3 (2025-04-16)OpenAI1665 ± 1248

Interactive version: theaggregate.ai/models · How It Works · Data refreshed daily, snapshot 2026-09-05.