GPT-6 Luna (Low): benchmark results

Provider: OpenAI. Access: API.

Unified ELO 1660 ± 1, rank #326 of 3363 rated models, from 61 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA-Omniscience Index - Software Engineering (SWE) - Go44Omniscience Index85.9
AA-Omniscience Index - Software Engineering (SWE) - Rust60Omniscience Index84.7
AA-Omniscience Index - Software Engineering (SWE) - Julia16Omniscience Index83.8
AA-Omniscience Index - Software Engineering (SWE) - Python36.5Omniscience Index83.7
AA-Omniscience Index - Software Engineering (SWE) - C52Omniscience Index82.1
AA-Omniscience Index - Software Engineering (SWE) - JavaScript36.36Omniscience Index82.1
AA-Omniscience Accuracy40.77Accuracy (%)81.5
AA-Omniscience Index - Software Engineering (SWE) - Swift40Omniscience Index81.4
AA-Omniscience Index - Software Engineering (SWE) - HTML38Omniscience Index80.2
AA-Omniscience Index - Software Engineering (SWE)26.5Omniscience Index79.9
AA-Omniscience Index - Software Engineering (SWE) - PHP24Omniscience Index78.7
AA-Omniscience Index - Software Engineering (SWE) - Java-12Omniscience Index76.6

Interactive version: theaggregate.ai/model?slug=gpt-6-luna-low · How It Works · Data refreshed daily, snapshot 2026-09-23.