GPT-5.6 Luna — benchmark results
OpenAI's fast, low-cost GPT-5.6 tier. Provider: OpenAI. Released 2026-07-09. Access: API.
Unified ELO 1864 ± 15, rank #91 of 1776 rated models, from 103 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Vals AI IOI | 72.92 | Accuracy (%) | 96.6 |
| Vals AI TaxEval v2 | 76.17 | Accuracy (%) | 96.5 |
| Vals AI SWE-bench Verified | 93 | Resolved (%) | 95.7 |
| Clerk LLM Leaderboard | 83.6 | Avg score (%) | 95.2 |
| ZeroEval GPQA Diamond | 92.3 | GPQA Diamond Score | 94.2 |
| Vals AI CyberBench | 83.9 | Accuracy (%) | 93.8 |
| Vals AI Vibe Code Bench | 77.06 | Accuracy (%) | 92.9 |
| Vals AI Terminal-Bench 2.1 | 79.03 | Accuracy (%) | 92.7 |
| SvelteBench | 98.9 | Average pass@1 (%) | 92.2 |
| WolfBench | 79 | Average Score (%) | 91.9 |
| Vals AI Finance Agent v2 | 55.04 | Accuracy (%) | 91.7 |
| Vals AI GPQA | 91.67 | Accuracy (%) | 91.4 |
Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna · How the rankings work · Data refreshed daily, snapshot 2026-07-22.