GPT-6 Luna (Medium): benchmark results

Provider: OpenAI. Access: API.

Unified ELO 1684 ± 1, rank #215 of 3363 rated models, from 62 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA-Omniscience Index - Software Engineering (SWE) - Kotlin42Omniscience Index90.3
AA-Omniscience Index - Software Engineering (SWE) - JavaScript50.91Omniscience Index88.6
AA-Omniscience Index - Software Engineering (SWE) - Rust64Omniscience Index88.3
AA-Omniscience Index - Software Engineering (SWE) - Python48Omniscience Index87.7
AA-Omniscience Index - Software Engineering (SWE) - Go48Omniscience Index87.2
AA-Omniscience Index - Software Engineering (SWE) - TypeScript48.89Omniscience Index86.9
AA-Omniscience Index - Software Engineering (SWE) - PHP48Omniscience Index86.7
AA-Omniscience Index - Software Engineering (SWE)36.2Omniscience Index84.8
AA-Omniscience Index - Software Engineering (SWE) - HTML50Omniscience Index84.6
AA-Omniscience Accuracy43.13Accuracy (%)84.5
Artificial Analysis Intelligence Index29.46Intelligence Index84.5
AA CritPt10.57Accuracy (%)82.9

Interactive version: theaggregate.ai/model?slug=gpt-6-luna-medium · How It Works · Data refreshed daily, snapshot 2026-09-23.