O4 Mini (Low): benchmark results

O4 Mini evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2025-04-16. Access: API.

Unified ELO 1578 ± 1, rank #523 of 1761 rated models, from 44 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HAL SciCode9.23Accuracy (%)96.7
UGI - Natural Intelligence45.54NatInt Score88.5
UGI - Writing46.88Writing Score86.7
HAL AssistantBench28.05Accuracy (%)85.7
HAL USACO53.09Accuracy (%)81.8
FlagEval VQA - Visual Puzzles37.1Score78.3
HAL GAIA Level 353.85Accuracy (%)78.1
HAL SWE-bench Verified Mini54Score (%)76.5
FlagEval VQA - Scene Understanding75.8Score73.9
HAL GAIA Level 171.7Accuracy (%)71.9
FlagEval VQA - Long-tail Recognition40.2Score69.6
FormationEval94.3Accuracy (%)62

Interactive version: theaggregate.ai/model?slug=o4-mini-low · How It Works · Data refreshed daily, snapshot 2026-09-05.