SWE Atlas: leaderboard

Metric: Score (self-reported). Source: benchmarklist.com. 38 models tracked.

Top models

#ModelScore
1Claude Opus 563.2
2Qwen 3.8 Max60.3
3GLM-5.248.12
4GPT-5.6 Sol46
5GPT-5.6 Sol (xHigh)46
6GPT-5.5 (xHigh)45.43
7GPT-5.545.4
8GPT-5.4 (xHigh)40.8
9Claude Fable 539
10GPT-5.3 Codex32.6
11DeepSeek V4 Pro27.15
12Muse Spark24.2
13GLM-520.5
14Gemini 3.1 Pro (Preview)13.5
15Kimi K2.513.1

Interactive version: theaggregate.ai/benchmark?slug=swe-atlas · How It Works · Data refreshed daily, snapshot 2026-09-05.