Grok 4.5 (Medium): benchmark results
Provider: xAI. Released 2026-07-08. Access: API.
Unified ELO 1733 ± 1, rank #56 of 3078 rated models, from 16 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| ObviousBench | 100 | Answer pass³ (%) | 97.7 |
| PetriBench - MinimumTokenSteps (Hard) | 66.8 | Exact-Match Accuracy (%) | 88.6 |
| DuelLab Overall | 47.9 | DuelLab Score | 80.3 |
| ARC-AGI-1 | 87.17 | Accuracy (%) | 72 |
| PetriBench - Deadlock (Hard) | 59 | Exact-Match Accuracy (%) | 71.4 |
| PetriBench - Hard | 48.9 | Exact-Match Accuracy (%) | 71.4 |
| PetriBench - Medium | 65 | Exact-Match Accuracy (%) | 68.6 |
| ARC-AGI-2 | 52.64 | Accuracy (%) | 67.5 |
| PetriBench - L4-Liveness (Hard) | 73.5 | Exact-Match Accuracy (%) | 65.7 |
| PetriBench - Easy | 83.8 | Exact-Match Accuracy (%) | 62.9 |
| DeepsecBench | 16.47 | Recall-weighted F2 score (%) | 62.2 |
| PetriBench - ReachableMarkings (Hard) | 12 | Exact-Match Accuracy (%) | 60 |
Interactive version: theaggregate.ai/model?slug=grok-4-5-medium · How It Works · Data refreshed daily, snapshot 2026-09-20.