GPT-5.6 Terra (Max): benchmark results

GPT-5.6 Terra evaluated at the max reasoning-effort setting. Provider: OpenAI. Released 2026-07-09. Access: API.

Unified ELO 1727 ± 1, rank #56 of 1761 rated models, from 81 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
APEX v169.5Score (%)100
Aikido CVE Rediscovery83.3Recall (%)100
AA CritPt30Accuracy (%)98.7
OTIS Mock AIME 2024-2599.72Accuracy (%)97.4
AA Terminal-Bench Hard57.58Accuracy (%)97.3
Epoch AI - Critpt30Score97.3
AA Long Context Reasoning83Accuracy (%)97
Chess Puzzles (Epoch AI)54Accuracy (%)97
AA-LCR79.67Accuracy (self-reported)96.1
FrontierMath - Tiers 1-3 (v2)85.96Accuracy (%, 285 private v2 problems)96.1
Artificial Analysis Intelligence Index46.77Intelligence Index95.3
Vals AI SWE-bench Verified95.4Resolved (%)94.8

Interactive version: theaggregate.ai/model?slug=gpt-5-6-terra-max · How It Works · Data refreshed daily, snapshot 2026-09-05.