AA-Briefcase - Analytical Quality Elo: leaderboard

Metric: Elo. Source: artificialanalysis.ai. 169 models tracked.

Top models

#ModelScore
1Qwen 3.8 Max (0902)1958.33
2Qwen3.8-Flash-Next1908.87
3Claude Opus 5 (Adaptive Reasoning, Max Effort)1880.61
4GLM-5.3 (Max)1762.24
5GPT-6 (Max)1753.18
6Muse Spark 1.3 (Max)1725.44
7GPT-6 (xHigh)1702.08
8Grok 4.6 (xHigh)1680.03
9GPT-6 (High)1670.47
10Grok 4.6 (High)1668.79
11Kimi K3 (Max)1651.95
12GPT-6 (Medium)1641.21
13GLM-5.3 Flash1634.74
14Qwen3.8 2.4T A95B1611.58
15Grok 4.6 (Medium)1604.18

Interactive version: theaggregate.ai/benchmark?slug=aa-briefcase-analytical-quality-elo · How It Works · Data refreshed daily, snapshot 2026-09-19.