O4 Mini — benchmark results
OpenAI's efficient o4-series reasoning model for fast math, coding, and visual tasks. Provider: OpenAI. Released 2025-04-16. Access: API.
Unified ELO 1646 ± 14, rank #379 of 1776 rated models, from 182 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MME-Reasoning | 57.2 | Overall Accuracy (%) | 100 |
| ZEROBench-Sub | 29.05 | Score (self-reported) | 97.4 |
| OJBench | 33.3 | Score (self-reported) | 97.2 |
| MMMU Benchmark | 81.6 | Validation Score | 96.8 |
| SnakeBench | 33.9 | TrueSkill Rating | 96.8 |
| TRLawBench | 84.4 | Stage 1 accuracy (self-reported) | 96.8 |
| TableBench | 60.75 | DP Score (%) | 96.8 |
| LLM Stats (AIME 2024) | 93.4 | Score (%) | 96.2 |
| VisualPuzzles | 57 | Overall Accuracy (%) | 94.6 |
| LLM Stats (MathVista) | 84.3 | Score (%) | 91.9 |
| MedGUIDE | 58.9 | Weighted Accuracy (self-reported) | 91.7 |
| SGI-Bench Dry Experiment | 35.79 | Dry Experiment Score | 91.7 |
Interactive version: theaggregate.ai/model?slug=o4-mini · How the rankings work · Data refreshed daily, snapshot 2026-07-22.