GPT-5.6 Sol (xHigh) — benchmark results

GPT-5.6 Sol evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 2096 ± 39, rank #10 of 1776 rated models, from 63 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Kotlin94Accuracy (%)100
CADGenBench0.53Aggregate CAD Score100
ErdosBench3.12Judge Average (0-4)100
Opus Magnum Bench70.86Human-normalized score (%)100
PM-LLM-Benchmark40.2Score100
AA Omniscience - Software Engineering (SWE) - Go86Accuracy (%)99.8
AA Omniscience - Humanities & Social Sciences57.7Accuracy (%)99.6
AA-Omniscience Accuracy57.97Accuracy (%)99.6
Artificial Analysis Intelligence Index57.65Intelligence Index99.6
AA Omniscience - Software Engineering (SWE) - TypeScript91.11Accuracy (%)99.4
ARC-AGI-197.5Accuracy (%)99.4
ARC-AGI-290Accuracy (%)99.4

Interactive version: theaggregate.ai/model?slug=gpt-5-6-sol-xhigh · How the rankings work · Data refreshed daily, snapshot 2026-07-22.