GPT-5.2 (Non-reasoning): benchmark results

GPT-5.2 evaluated with reasoning disabled. Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1610 ± 1, rank #384 of 1761 rated models, from 54 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CritPt60Accuracy (self-reported)91.9
UGI - Natural Intelligence50.84NatInt Score90.4
AA Global-MMLU-Lite - Yoruba72.17Accuracy (%)79.3
AA Omniscience - Software Engineering (SWE)47.7Accuracy (%)78.8
AA Global-MMLU-Lite - Burmese83.33Accuracy (%)78.4
AA Global-MMLU-Lite - Hindi87.42Accuracy (%)78.4
AA Global-MMLU-Lite86.8Accuracy (%)77.5
AA Global-MMLU-Lite - Arabic87.42Accuracy (%)77.5
AA Global-MMLU-Lite - Japanese88.75Accuracy (%)77.5
AA Global-MMLU-Lite - Swahili83.92Accuracy (%)77.5
AA Global-MMLU-Lite - Portuguese90.25Accuracy (%)75.7
AA Terminal-Bench Hard31.82Accuracy (%)75.3

Interactive version: theaggregate.ai/model?slug=gpt-5-2-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.