GPT-5.6 Luna (Low) — benchmark results
GPT-5.6 Luna evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.
Unified ELO 1780 ± 16, rank #162 of 1776 rated models, from 39 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA Omniscience - Software Engineering (SWE) - TypeScript | 72.22 | Accuracy (%) | 94.1 |
| AA Omniscience - Software Engineering (SWE) - Kotlin | 64 | Accuracy (%) | 93.3 |
| AA Omniscience - Software Engineering (SWE) - PHP | 70 | Accuracy (%) | 92.2 |
| AA Omniscience - Software Engineering (SWE) - Python | 67.5 | Accuracy (%) | 92.2 |
| AA Omniscience - Software Engineering (SWE) - Go | 64 | Accuracy (%) | 91.6 |
| AA Omniscience - Software Engineering (SWE) - C | 73 | Accuracy (%) | 89.8 |
| AA Omniscience - Software Engineering (SWE) | 62.1 | Accuracy (%) | 89.7 |
| AA Omniscience - Software Engineering (SWE) - JavaScript | 66.36 | Accuracy (%) | 89.7 |
| AA Omniscience - Software Engineering (SWE) - R | 50 | Accuracy (%) | 89.7 |
| AA Omniscience - Software Engineering (SWE) - Rust | 72 | Accuracy (%) | 88.5 |
| AA Omniscience - Software Engineering (SWE) - Swift | 68 | Accuracy (%) | 88.4 |
| AA Omniscience - Software Engineering (SWE) - Java | 39 | Accuracy (%) | 86.9 |
Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.