GPT-5.6 Sol (xHigh): benchmark results
GPT-5.6 Sol evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.
Unified ELO 1765 ± 1, rank #21 of 1761 rated models, from 101 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Chatbot Arena (Search) | 1257 | Arena Score | 100 |
| DuelLab Overall | 87.3 | DuelLab Score | 100 |
| ErdosBench | 3.12 | Judge Average (0-4) | 100 |
| LLM Chess (Saplin) | 1549.7 | ELO | 100 |
| Opus Magnum Bench | 70.86 | Human-normalized score (%) | 100 |
| PM-LLM-Benchmark | 40.2 | Score | 100 |
| Chatbot Arena (Text - Japanese) | 1522 | Arena Score | 99.6 |
| AA Terminal-Bench Hard | 61.36 | Accuracy (%) | 98.8 |
| Design Arena (Game Dev) | 1397 | Elo | 98.8 |
| Design Arena (Website) | 1335 | Elo | 98.8 |
| Chatbot Arena (Text - German) | 1500 | Arena Score | 98.6 |
| Design Arena (3D) | 1417 | Elo | 98.6 |
Interactive version: theaggregate.ai/model?slug=gpt-5-6-sol-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.