AA Omniscience - Software Engineering (SWE) - JavaScript — leaderboard

Metric: Accuracy (%). Source: artificialanalysis.ai. 449 models tracked.

Top models

#ModelScore
1GPT-5.3 Codex (xHigh)90.91
2GPT-5.6 Sol (Max)89.09
3GPT-5.6 Sol (Low)89.09
4GPT-5.4 (xHigh)88.18
5GPT-5.6 Sol (xHigh)88.18
6GPT-5.5 (Medium)88.18
7GPT-5.5 (xHigh)86.36
8GPT-5.5 (High)86.36
9GPT-5.6 Sol (High)86.36
10GPT-5.4 (Low)85.45
11Claude Opus 4.6 (Adaptive Reasoning, Max Effort)84.55
12GPT-5.5 (Low)84.55
13GPT-5.6 Sol (Medium)83.64
14Claude Opus 4.8 (Adaptive Reasoning, Max Effort)81.82
15GPT-5.6 Terra (Max)79.09

Interactive version: theaggregate.ai/benchmark?slug=aa-omniscience-software-engineering-swe-javascript · How the rankings work · Data refreshed daily, snapshot 2026-07-22.