GPT-5.6 Luna (Non-reasoning) — benchmark results

GPT-5.6 Luna evaluated with reasoning disabled. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1668 ± 27, rank #329 of 1776 rated models, from 37 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence45.85NatInt Score89.3
AA Omniscience - Software Engineering (SWE) - Go52Accuracy (%)87.8
AA Omniscience - Software Engineering (SWE) - Python54Accuracy (%)87.3
AA Omniscience - Software Engineering (SWE) - Kotlin48Accuracy (%)86.6
AA Omniscience - Software Engineering (SWE) - JavaScript58.18Accuracy (%)86.2
AA Omniscience - Software Engineering (SWE) - TypeScript54.44Accuracy (%)84.8
AA Omniscience - Software Engineering (SWE) - Julia36Accuracy (%)84.6
AA Omniscience - Software Engineering (SWE)49.1Accuracy (%)84.2
AA Omniscience - Software Engineering (SWE) - HTML54Accuracy (%)83.3
AA Omniscience - Software Engineering (SWE) - PHP48Accuracy (%)82.7
AA Omniscience - Software Engineering (SWE) - Java33Accuracy (%)82.5
AA Omniscience - Software Engineering (SWE) - C62Accuracy (%)80.5

Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.