GPT-5.6 Terra (xHigh) — benchmark results

GPT-5.6 Terra evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1979 ± 34, rank #31 of 1776 rated models, from 47 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Terminal-Bench Hard62.88Accuracy (%)99.5
AA CritPt27.14Accuracy (%)98.8
Artificial Analysis Intelligence Index51.6Intelligence Index97.6
AA Humanity's Last Exam40.04Accuracy (%)97
AA Omniscience - Software Engineering (SWE) - Go74Accuracy (%)96.7
AA Omniscience - Software Engineering (SWE) - Python78.5Accuracy (%)96.4
AA Omniscience - Software Engineering (SWE) - Rust80Accuracy (%)96
AA Omniscience - Software Engineering (SWE) - JavaScript77.27Accuracy (%)95.5
AA Long Context Reasoning71.33Accuracy (%)95.4
AA GPQA Diamond90.81Accuracy (%)95.1
AA Omniscience - Health41.8Accuracy (%)94.9
AA Omniscience - Software Engineering (SWE) - Java55Accuracy (%)94.9

Interactive version: theaggregate.ai/model?slug=gpt-5-6-terra-xhigh · How the rankings work · Data refreshed daily, snapshot 2026-07-22.