OTIS Mock AIME 2024-25 — leaderboard

Mock AIME competition problems from the OTIS math olympiad program. Tests creative mathematical problem-solving at olympiad level. Evaluated by Epoch AI.

Metric: Accuracy (%). Source: epoch.ai. Status: saturated. 155 models tracked.

Top models

#ModelScore
1GPT-5.5 (xHigh)100
2Human Expert100
3GPT-5.6 Sol (Max)100
4GPT-5.5 Pro (xHigh)100
5GPT-5.6 Terra (Max)99.72
6Claude Fable 5 (Max)99.72
7Claude Opus 4.8 (Max)98.33
8GPT-5.6 Luna (Max)98.33
9Claude Opus 4.7 (xHigh)97.8
10Grok 4.5 (High)97.78
11Kimi K3 (Max)97.22
12DeepSeek V4 Pro (Max)96.67
13Kimi K2.7 Code96.39
14Kimi K2.696.11
15GPT-5.2 (High)96.11

Interactive version: theaggregate.ai/benchmark?slug=otis-mock-aime-2024-25 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.