GPT-5.6 Luna (Non-reasoning): benchmark results

GPT-5.6 Luna evaluated with reasoning disabled. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1587 ± 1, rank #485 of 1761 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence45.85NatInt Score88.6
AA Omniscience - Software Engineering (SWE)49.9Accuracy (%)80.3
UGI - Writing40.98Writing Score76.3
AA-Omniscience Accuracy28.6Accuracy (%)71.5
AA Omniscience - Law18.4Accuracy (%)68.7
AA Omniscience - Business21.8Accuracy (%)68
AA Omniscience - Health25Accuracy (%)66.6
Artificial Analysis Intelligence Index19.32Intelligence Index65.1
AA Omniscience - Science, Engineering & Mathematics32Accuracy (%)63.6
AA Omniscience - Humanities & Social Sciences24.5Accuracy (%)61.8
FrontierMath - Tiers 1-3 (v2)39.65Accuracy (%, 285 private v2 problems)60.6
AA Omniscience-24.95Score60.4

Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.