GPT-5.6 Luna — benchmark results

OpenAI's fast, low-cost GPT-5.6 tier. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1864 ± 15, rank #91 of 1776 rated models, from 103 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Vals AI IOI72.92Accuracy (%)96.6
Vals AI TaxEval v276.17Accuracy (%)96.5
Vals AI SWE-bench Verified93Resolved (%)95.7
Clerk LLM Leaderboard83.6Avg score (%)95.2
ZeroEval GPQA Diamond92.3GPQA Diamond Score94.2
Vals AI CyberBench83.9Accuracy (%)93.8
Vals AI Vibe Code Bench77.06Accuracy (%)92.9
Vals AI Terminal-Bench 2.179.03Accuracy (%)92.7
SvelteBench98.9Average pass@1 (%)92.2
WolfBench79Average Score (%)91.9
Vals AI Finance Agent v255.04Accuracy (%)91.7
Vals AI GPQA91.67Accuracy (%)91.4

Interactive version: theaggregate.ai/model?slug=gpt-5-6-luna · How the rankings work · Data refreshed daily, snapshot 2026-07-22.