GPT-5.6 Terra: benchmark results

OpenAI's balanced GPT-5.6 tier for everyday reasoning and coding work. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1719 ± 1, rank #31 of 1392 rated models, from 213 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - GLP - Abstract Reasoning98Score (%)100
SecIT Bench (Codex)71.88Accuracy (%)100
Nejumi 4 - GLP - Reasoning94.33Score (%)98.4
BenchmarkList ECI151.05Capability Index (ECI)97.8
Nejumi 4 - ALT - Controllability93.44Score (%)97.5
Nejumi 4 - GLP - Basic Language86.95Score (%)97.5
Nejumi 4 - GLP Average83.63Score (%)97.5
LLM Stats Score51.16LLM Stats Score (conservative rating)96.9
WolfBench82Average Score (%)96.8
Nejumi 4 - ALT - Robustness99Score (%)96.7
AIIQ Composite IQ132Composite IQ (self-reported)96.3
Nejumi 4 - SWE-Bench (Japanese)70Score (%)96.3

Interactive version: theaggregate.ai/model?slug=gpt-5-6-terra · How It Works · Data refreshed daily, snapshot 2026-09-05.