GPT-5.6 Terra: benchmark results
OpenAI's balanced GPT-5.6 tier for everyday reasoning and coding work. Provider: OpenAI. Released 2026-07-09. Access: API.
Unified ELO 1719 ± 1, rank #31 of 1392 rated models, from 213 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Nejumi 4 - GLP - Abstract Reasoning | 98 | Score (%) | 100 |
| SecIT Bench (Codex) | 71.88 | Accuracy (%) | 100 |
| Nejumi 4 - GLP - Reasoning | 94.33 | Score (%) | 98.4 |
| BenchmarkList ECI | 151.05 | Capability Index (ECI) | 97.8 |
| Nejumi 4 - ALT - Controllability | 93.44 | Score (%) | 97.5 |
| Nejumi 4 - GLP - Basic Language | 86.95 | Score (%) | 97.5 |
| Nejumi 4 - GLP Average | 83.63 | Score (%) | 97.5 |
| LLM Stats Score | 51.16 | LLM Stats Score (conservative rating) | 96.9 |
| WolfBench | 82 | Average Score (%) | 96.8 |
| Nejumi 4 - ALT - Robustness | 99 | Score (%) | 96.7 |
| AIIQ Composite IQ | 132 | Composite IQ (self-reported) | 96.3 |
| Nejumi 4 - SWE-Bench (Japanese) | 70 | Score (%) | 96.3 |
Interactive version: theaggregate.ai/model?slug=gpt-5-6-terra · How It Works · Data refreshed daily, snapshot 2026-09-05.