GPT-5.1 Codex Mini — benchmark results
OpenAI's compact Codex-specialized GPT-5.1 tier. Provider: OpenAI. Released 2025-11-19. Access: API.
Unified ELO 1610 ± 45, rank #458 of 1776 rated models, from 18 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SnakeBench | 36.5 | TrueSkill Rating | 99.1 |
| AI Chess Leaderboard (Reasoning) | 952 | Elo | 80.6 |
| AA-LCR | 62.7 | Score (self-reported) | 79.7 |
| Terminal-Bench 2.0 | 61.6 | Accuracy (%) | 75.9 |
| AI Chess Leaderboard (Continuation) | 812 | Elo | 73.3 |
| BenchTable | 56.5 | Total Score (%) | 65.1 |
| Design Arena (Game Dev) | 1151 | Elo | 37.1 |
| Design Arena (Website) | 1138 | Elo | 32.7 |
| Design Arena (UI Components) | 1122 | Elo | 31.6 |
| CritPt | 0 | Accuracy (self-reported) | 30.3 |
| Design Arena (Data Viz) | 1133 | Elo | 29 |
| Arena AI Code | 1239 | Arena ELO (self-reported) | 15.9 |
Interactive version: theaggregate.ai/model?slug=gpt-5-1-codex-mini · How the rankings work · Data refreshed daily, snapshot 2026-07-22.