GPT-6 Luna (xHigh): benchmark results

Provider: OpenAI. Access: API.

Unified ELO 1705 ± 1, rank #148 of 3363 rated models, from 61 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA-Omniscience Index - Software Engineering (SWE) - Go60Omniscience Index92
AA-Omniscience Index - Software Engineering (SWE) - Kotlin44Omniscience Index91.4
AA-Omniscience Index - Software Engineering (SWE) - PHP60Omniscience Index91
Artificial Analysis Intelligence Index33.88Intelligence Index88.7
AA CritPt17.43Accuracy (%)88.5
AA-Omniscience Index - Software Engineering (SWE) - HTML56Omniscience Index88.3
AA-Omniscience Index - Software Engineering (SWE) - Rust64Omniscience Index88.3
AA-Omniscience Index - Software Engineering (SWE) - Python49.5Omniscience Index88.2
AA Long Context Reasoning80Accuracy (%)87.4
AA-Omniscience Index - Software Engineering (SWE) - TypeScript50Omniscience Index87.2
AA-Omniscience Index - Software Engineering (SWE) - JavaScript47.27Omniscience Index86.4
AA-Omniscience Index - Software Engineering (SWE)38Omniscience Index85.9

Interactive version: theaggregate.ai/model?slug=gpt-6-luna-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-23.