O3 (2025-04-16) (High) — benchmark results
O3 (2025-04-16) evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2025-04-16. Access: API.
Unified ELO 1754 ± 29, rank #190 of 1776 rated models, from 20 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| UGI - Writing | 66.75 | Writing Score | 97.1 |
| UGI - Natural Intelligence | 66.19 | NatInt Score | 97 |
| MATH Level 5 | 97.77 | Accuracy (%) | 95.4 |
| SEAL - EnigmaEval | 11.91 | Score | 87.5 |
| UGI Leaderboard | 46.52 | UGI Score | 83.7 |
| SimpleQA Verified | 53 | Accuracy (%) | 76.6 |
| MultiNRC | 45.5 | Score (self-reported) | 71.1 |
| SEAL - MultiNRC | 45.5 | Score | 69.8 |
| OTIS Mock AIME 2024-25 | 83.89 | Accuracy (%) | 67.3 |
| LiveCodeBench Pro | 1010 | Rating (CF-style) | 52.8 |
| OpenCompass Language - Dialogue | 96.1 | Score (%) | 52 |
| SEAL - TutorBench | 52.09 | Score | 50 |
Interactive version: theaggregate.ai/model?slug=o3-2025-04-16-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.