GPT-6 Luna (Non-reasoning): benchmark results
Provider: OpenAI. Access: API.
Unified ELO 1629 ± 1, rank #488 of 3363 rated models, from 61 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA-Omniscience Index - Software Engineering (SWE) - Python | 34.5 | Omniscience Index | 83.3 |
| AA-Omniscience Index - Software Engineering (SWE) - JavaScript | 22.73 | Omniscience Index | 77.7 |
| AA-Omniscience Index - Software Engineering (SWE) - Go | 14 | Omniscience Index | 76.7 |
| AA-Omniscience Index - Software Engineering (SWE) - Rust | 50 | Omniscience Index | 76.4 |
| AA-Omniscience Index - Software Engineering (SWE) - PHP | 14 | Omniscience Index | 75.9 |
| AA-Omniscience Index - Software Engineering (SWE) | 11.8 | Omniscience Index | 74.6 |
| AA-Omniscience Index - Software Engineering (SWE) - TypeScript | 15.56 | Omniscience Index | 74.2 |
| AA-Omniscience Accuracy | 31.85 | Accuracy (%) | 73.2 |
| AA-Omniscience Index - Software Engineering (SWE) - Java | -23 | Omniscience Index | 69.4 |
| AA-Omniscience Index - Software Engineering (SWE) - Julia | -20 | Omniscience Index | 68.9 |
| AA-Omniscience Index - Software Engineering (SWE) - C | 21 | Omniscience Index | 68.4 |
| AA-Omniscience Index - Software Engineering (SWE) - Dart | -12 | Omniscience Index | 67.8 |
Interactive version: theaggregate.ai/model?slug=gpt-6-luna-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-23.