AA Omniscience - Software Engineering (SWE) - Kotlin — leaderboard

Metric: Accuracy (%). Source: artificialanalysis.ai. 449 models tracked.

Top models

#ModelScore
1GPT-5.6 Sol (xHigh)94
2GPT-5.3 Codex (xHigh)90
3GPT-5.6 Sol (Max)88
4GPT-5.5 (High)86
5GPT-5.6 Sol (High)86
6GPT-5.5 (xHigh)84
7GPT-5.4 (xHigh)84
8GPT-5.6 Sol (Medium)82
9GPT-5.6 Sol (Low)82
10GPT-5.5 (Medium)78
11GPT-5.5 (Low)78
12GPT-5.4 (Low)74
13GPT-5.2 (xHigh)72
14GPT-5.6 Luna (xHigh)70
15Claude Opus 4.7 (Adaptive Reasoning, Max Effort)70

Interactive version: theaggregate.ai/benchmark?slug=aa-omniscience-software-engineering-swe-kotlin · How the rankings work · Data refreshed daily, snapshot 2026-07-22.