GPT-5.2 (Low): benchmark results
GPT-5.2 evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2025-12-11. Access: API.
Unified ELO 1609 ± 1, rank #389 of 1761 rated models, from 42 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| UGI - Natural Intelligence | 55.79 | NatInt Score | 92.1 |
| UGI - Writing | 43.85 | Writing Score | 83.9 |
| LLM Chess (Saplin) | 782.5 | ELO | 82.6 |
| Pencil Puzzle Bench - Nurimisaki | 13.3 | Direct-ask Success Rate (%) | 81 |
| NonoBench | 46.7 | Overall Accuracy (%) | 79.8 |
| Pencil Puzzle Bench - Slitherlink | 6.7 | Direct-ask Success Rate (%) | 74 |
| IH-Benchmark | 87.8 | Overall Compliance (%) | 72.2 |
| Pencil Puzzle Bench - Light Up | 6.7 | Direct-ask Success Rate (%) | 71 |
| Pencil Puzzle Bench - Shikaku | 6.7 | Direct-ask Success Rate (%) | 71 |
| FrontierMath - Tiers 1-3 | 26.55 | Accuracy (%, 290 problems) | 69.7 |
| Chess Puzzles (Epoch AI) | 23 | Accuracy (%) | 69.6 |
| OTIS Mock AIME 2024-25 | 78.89 | Accuracy (%) | 62.5 |
Interactive version: theaggregate.ai/model?slug=gpt-5-2-low · How It Works · Data refreshed daily, snapshot 2026-09-05.