GPT-5.6 Terra (High) — benchmark results

GPT-5.6 Terra evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1944 ± 32, rank #42 of 1776 rated models, from 46 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
PM-LLM-Benchmark38.4Score98.1
AA Terminal-Bench Hard57.58Accuracy (%)97.3
AA CritPt22.86Accuracy (%)97.2
AA Omniscience - Software Engineering (SWE) - TypeScript78.89Accuracy (%)96.3
AA Long Context Reasoning72.33Accuracy (%)96.1
AA Omniscience - Software Engineering (SWE) - Python78Accuracy (%)96.1
AA Omniscience - Software Engineering (SWE) - Kotlin68Accuracy (%)95.8
Artificial Analysis Intelligence Index48.95Intelligence Index95.8
WeirdML78.27Average Score95.6
AA Omniscience - Software Engineering (SWE) - JavaScript77.27Accuracy (%)95.5
AA Omniscience - Health42.2Accuracy (%)95.1
AA Omniscience - Software Engineering (SWE) - Go68Accuracy (%)94.5

Interactive version: theaggregate.ai/model?slug=gpt-5-6-terra-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.