GPT-5.2 (Non-reasoning): benchmark results
GPT-5.2 evaluated with reasoning disabled. Provider: OpenAI. Released 2025-12-11. Access: API.
Unified ELO 1610 ± 1, rank #384 of 1761 rated models, from 54 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CritPt | 60 | Accuracy (self-reported) | 91.9 |
| UGI - Natural Intelligence | 50.84 | NatInt Score | 90.4 |
| AA Global-MMLU-Lite - Yoruba | 72.17 | Accuracy (%) | 79.3 |
| AA Omniscience - Software Engineering (SWE) | 47.7 | Accuracy (%) | 78.8 |
| AA Global-MMLU-Lite - Burmese | 83.33 | Accuracy (%) | 78.4 |
| AA Global-MMLU-Lite - Hindi | 87.42 | Accuracy (%) | 78.4 |
| AA Global-MMLU-Lite | 86.8 | Accuracy (%) | 77.5 |
| AA Global-MMLU-Lite - Arabic | 87.42 | Accuracy (%) | 77.5 |
| AA Global-MMLU-Lite - Japanese | 88.75 | Accuracy (%) | 77.5 |
| AA Global-MMLU-Lite - Swahili | 83.92 | Accuracy (%) | 77.5 |
| AA Global-MMLU-Lite - Portuguese | 90.25 | Accuracy (%) | 75.7 |
| AA Terminal-Bench Hard | 31.82 | Accuracy (%) | 75.3 |
Interactive version: theaggregate.ai/model?slug=gpt-5-2-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.