GPT-6 Luna (Non-reasoning): benchmark results

Provider: OpenAI. Access: API.

Unified ELO 1629 ± 1, rank #488 of 3363 rated models, from 61 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA-Omniscience Index - Software Engineering (SWE) - Python34.5Omniscience Index83.3
AA-Omniscience Index - Software Engineering (SWE) - JavaScript22.73Omniscience Index77.7
AA-Omniscience Index - Software Engineering (SWE) - Go14Omniscience Index76.7
AA-Omniscience Index - Software Engineering (SWE) - Rust50Omniscience Index76.4
AA-Omniscience Index - Software Engineering (SWE) - PHP14Omniscience Index75.9
AA-Omniscience Index - Software Engineering (SWE)11.8Omniscience Index74.6
AA-Omniscience Index - Software Engineering (SWE) - TypeScript15.56Omniscience Index74.2
AA-Omniscience Accuracy31.85Accuracy (%)73.2
AA-Omniscience Index - Software Engineering (SWE) - Java-23Omniscience Index69.4
AA-Omniscience Index - Software Engineering (SWE) - Julia-20Omniscience Index68.9
AA-Omniscience Index - Software Engineering (SWE) - C21Omniscience Index68.4
AA-Omniscience Index - Software Engineering (SWE) - Dart-12Omniscience Index67.8

Interactive version: theaggregate.ai/model?slug=gpt-6-luna-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-23.