GPT-5.6 Sol (xHigh): benchmark results

GPT-5.6 Sol evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1765 ± 1, rank #21 of 1761 rated models, from 101 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chatbot Arena (Search)1257Arena Score100
DuelLab Overall87.3DuelLab Score100
ErdosBench3.12Judge Average (0-4)100
LLM Chess (Saplin)1549.7ELO100
Opus Magnum Bench70.86Human-normalized score (%)100
PM-LLM-Benchmark40.2Score100
Chatbot Arena (Text - Japanese)1522Arena Score99.6
AA Terminal-Bench Hard61.36Accuracy (%)98.8
Design Arena (Game Dev)1397Elo98.8
Design Arena (Website)1335Elo98.8
Chatbot Arena (Text - German)1500Arena Score98.6
Design Arena (3D)1417Elo98.6

Interactive version: theaggregate.ai/model?slug=gpt-5-6-sol-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.