GPT-5.6 Sol (Max) — benchmark results
GPT-5.6 Sol evaluated at the max reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.
Unified ELO 2175 ± 48, rank #5 of 1776 rated models, from 58 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA CritPt | 32.29 | Accuracy (%) | 100 |
| AA Omniscience - Software Engineering (SWE) - HTML | 92 | Accuracy (%) | 100 |
| AA Omniscience - Software Engineering (SWE) - PHP | 96 | Accuracy (%) | 100 |
| AA Omniscience - Software Engineering (SWE) - TypeScript | 92.22 | Accuracy (%) | 100 |
| AA Terminal-Bench Hard | 65.91 | Accuracy (%) | 100 |
| ARC-AGI-2 | 92.5 | Accuracy (%) | 100 |
| ARC-AGI-3 | 7.78 | Accuracy (%) | 100 |
| AutomationBench | 18.1 | Pass Rate (%) | 100 |
| Epoch AI - Critpt | 32.3 | Score | 100 |
| FrontierMath - Tiers 1-3 (v2) | 89.12 | Accuracy (%, 285 private v2 problems) | 100 |
| MathArena - ARXIV June | 86.73 | Accuracy (%) | 100 |
| Riemann-bench | 74.4 | Score (%) | 100 |
Interactive version: theaggregate.ai/model?slug=gpt-5-6-sol-max · How the rankings work · Data refreshed daily, snapshot 2026-07-22.