GPT-5.6 Sol (Max): benchmark results

GPT-5.6 Sol evaluated at the max reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1772 ± 1, rank #17 of 1761 rated models, from 124 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA CritPt32.29Accuracy (%)100
AA Terminal-Bench Hard65.91Accuracy (%)100
E-Commerce Bench1431Final Assets (¥k, mean of 5 episodes)100
Epoch AI - Critpt32.3Score100
GDP.pdf30.7Strict Pass Rate (%)100
HWE-Bench (Codex CLI)79.9Resolved (%)100
MathArena - ARXIV June86.73Accuracy (%)100
Riemann-bench74.4Score (%)100
Vals AI ReverseEngBench30.53Fully Solved (%)100
ZeroBench30Score (%)100
Vals AI GPQA95.2Accuracy (%)99.3
ARC-AGI-292.5Accuracy (%)99.1

Interactive version: theaggregate.ai/model?slug=gpt-5-6-sol-max · How It Works · Data refreshed daily, snapshot 2026-09-05.