O3 (Low) — benchmark results
O3 evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2025-04-16. Access: API.
Unified ELO 1708 ± 39, rank #261 of 1776 rated models, from 11 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| UGI - Natural Intelligence | 65.53 | NatInt Score | 96.9 |
| UGI - Writing | 65.79 | Writing Score | 96.7 |
| UGI Leaderboard | 52.09 | UGI Score | 93.3 |
| LLM Chess (Saplin) | 738.6 | ELO | 87.9 |
| Epoch AI - ECI | 147.07 | ECI Score | 66 |
| DROP | 82.3 | F1 Score | 63.3 |
| FrontierMath - Tiers 1-3 | 9.72 | Accuracy (%, 290 problems) | 44.4 |
| ARC-AGI-1 | 41.5 | Accuracy (%) | 43.5 |
| ARC-AGI-2 | 1.99 | Accuracy (%) | 31.9 |
| UGI - Willingness (W/10) | 2.2 | W/10 Score | 15.2 |
| GDPval (OpenAI Evals) | 11.8 | Win Rate (%) | 6.7 |
Interactive version: theaggregate.ai/model?slug=o3-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.