GPT-5.6 Luna (Medium) — benchmark results

GPT-5.6 Luna evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1818 ± 17, rank #127 of 1776 rated models, from 43 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Go70Accuracy (%)95.2
AA Omniscience - Software Engineering (SWE) - Kotlin66Accuracy (%)94.6
AA Omniscience - Software Engineering (SWE) - Python68.5Accuracy (%)92.6
AA Omniscience - Software Engineering (SWE) - C76Accuracy (%)92
AA Omniscience - Software Engineering (SWE) - JavaScript70.91Accuracy (%)91.9
AA Omniscience - Software Engineering (SWE) - Rust76Accuracy (%)91.7
AA Omniscience - Software Engineering (SWE) - Swift72Accuracy (%)91.7
AA Omniscience - Software Engineering (SWE) - HTML70Accuracy (%)91.2
AA Omniscience - Software Engineering (SWE)64Accuracy (%)91
AA Omniscience - Software Engineering (SWE) - Dart50Accuracy (%)90.8
AA Omniscience - Software Engineering (SWE) - TypeScript66.67Accuracy (%)90.4
AA Omniscience - Software Engineering (SWE) - PHP64Accuracy (%)89.8

Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna-medium · How the rankings work · Data refreshed daily, snapshot 2026-07-22.