GPT-6 Luna (Low): benchmark results
Provider: OpenAI. Access: API.
Unified ELO 1660 ± 1, rank #326 of 3363 rated models, from 61 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA-Omniscience Index - Software Engineering (SWE) - Go | 44 | Omniscience Index | 85.9 |
| AA-Omniscience Index - Software Engineering (SWE) - Rust | 60 | Omniscience Index | 84.7 |
| AA-Omniscience Index - Software Engineering (SWE) - Julia | 16 | Omniscience Index | 83.8 |
| AA-Omniscience Index - Software Engineering (SWE) - Python | 36.5 | Omniscience Index | 83.7 |
| AA-Omniscience Index - Software Engineering (SWE) - C | 52 | Omniscience Index | 82.1 |
| AA-Omniscience Index - Software Engineering (SWE) - JavaScript | 36.36 | Omniscience Index | 82.1 |
| AA-Omniscience Accuracy | 40.77 | Accuracy (%) | 81.5 |
| AA-Omniscience Index - Software Engineering (SWE) - Swift | 40 | Omniscience Index | 81.4 |
| AA-Omniscience Index - Software Engineering (SWE) - HTML | 38 | Omniscience Index | 80.2 |
| AA-Omniscience Index - Software Engineering (SWE) | 26.5 | Omniscience Index | 79.9 |
| AA-Omniscience Index - Software Engineering (SWE) - PHP | 24 | Omniscience Index | 78.7 |
| AA-Omniscience Index - Software Engineering (SWE) - Java | -12 | Omniscience Index | 76.6 |
Interactive version: theaggregate.ai/model?slug=gpt-6-luna-low · How It Works · Data refreshed daily, snapshot 2026-09-23.