GPT-5.6 Terra (xHigh): benchmark results

GPT-5.6 Terra evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1706 ± 1, rank #89 of 1761 rated models, from 92 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Terminal-Bench Hard62.88Accuracy (%)99.5
LLM Chess (Saplin)1293ELO96.3
AA CritPt27.14Accuracy (%)96.2
Vals AI TaxEval v276.17Accuracy (%)96.2
Chatbot Arena (Text - French)1506Arena Score95.3
Chatbot Arena (Text - German)1488Arena Score94.6
Chatbot Arena (Text - Math)1482Arena Score94.2
ProofBench71Score (self-reported)93.9
Artificial Analysis Intelligence Index44.39Intelligence Index93.6
Chatbot Arena (Text - Japanese)1474Arena Score93.5
Chatbot Arena (Text - Chinese)1519Arena Score92.7
AA Omniscience - Software Engineering (SWE)71.5Accuracy (%)92.6

Interactive version: theaggregate.ai/model?slug=gpt-5-6-terra-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.