GPT-5.3 Codex (High) — benchmark results

GPT-5.3 Codex evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2026-02-05. Access: API.

Unified ELO 1879 ± 17, rank #81 of 1776 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
APEX v1 Investment Banking65Score (%)100
SlopCodeBench26.02Isolated Solved (%)93.8
Epoch AI - ECI155.57ECI Score88.1
APEX v1 Consulting65.5Score (%)83.3
APEX-Agents46.9Mean Score (ReAct) (self-reported)79.5
Epoch AI - Apex Agents31.7Score78.1
PrinzBench52Score (x/99)69.6
BinaryAudit82.46Avg Success Rate (%)68
InferenceBench5.49Speedup Score63.6
LiveBench73.18LiveBench average (self-reported)47.6
APEX v1 Big Law69.8Score (%)33.3
APEX v1 Medicine (MD)58.1Score (%)25

Interactive version: theaggregate.ai/model?slug=gpt-5-3-codex-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.