GPT-5.6 Luna (Low) — benchmark results

GPT-5.6 Luna evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1780 ± 16, rank #162 of 1776 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - TypeScript72.22Accuracy (%)94.1
AA Omniscience - Software Engineering (SWE) - Kotlin64Accuracy (%)93.3
AA Omniscience - Software Engineering (SWE) - PHP70Accuracy (%)92.2
AA Omniscience - Software Engineering (SWE) - Python67.5Accuracy (%)92.2
AA Omniscience - Software Engineering (SWE) - Go64Accuracy (%)91.6
AA Omniscience - Software Engineering (SWE) - C73Accuracy (%)89.8
AA Omniscience - Software Engineering (SWE)62.1Accuracy (%)89.7
AA Omniscience - Software Engineering (SWE) - JavaScript66.36Accuracy (%)89.7
AA Omniscience - Software Engineering (SWE) - R50Accuracy (%)89.7
AA Omniscience - Software Engineering (SWE) - Rust72Accuracy (%)88.5
AA Omniscience - Software Engineering (SWE) - Swift68Accuracy (%)88.4
AA Omniscience - Software Engineering (SWE) - Java39Accuracy (%)86.9

Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.