AA-Omniscience Index - Software Engineering (SWE) - R: leaderboard

Metric: Omniscience Index. Source: artificialanalysis.ai. 527 models tracked.

Top models

#ModelScore
1GPT-6 (xHigh)62
2Claude Opus 5 (Adaptive Reasoning, Max Effort)58
3GPT-6 (Medium)58
4GPT-6 (Max)56
5GPT-6 (High)56
6Grok 4.6 (High)54
7Claude Opus 4.8 (Adaptive Reasoning, Max Effort)54
8GPT-6 (Low)54
9Claude Opus 4.6 (Adaptive Reasoning, Max Effort)52
10Grok 4.5 (High)50
11GPT-5.4 (Low)50
12Grok 4.6 (Low)50
13GPT-5.5 (High)48
14Muse Spark 1.3 (Max)48
15GPT-5.5 (Medium)48

Interactive version: theaggregate.ai/benchmark?slug=aa-omniscience-index-software-engineering-swe-r · How It Works · Data refreshed daily, snapshot 2026-09-19.