Gemini 2.5 Pro (Thinking) — benchmark results
Provider: Google. Released 2025-06-05. Access: API.
Unified ELO 1728 ± 35, rank #267 of 1806 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMMU Benchmark | 84 | Validation Score | 97.9 |
| SEAL - AudioMultiChallenge - Text Output | 46.9 | Score | 82.4 |
| MMSI-Bench | 37 | Accuracy (%) | 81.6 |
| AudioMC | 46.9 | Score (self-reported) | 81.5 |
| DentalGPT Dental Eval Suite | 57.9 | Average Accuracy (self-reported) | 73.3 |
| ALE-Bench | 785.52 | Performance (Self-Refine x1) (self-reported) | 56.4 |
| VitaBench 2.0 | 33.1 | Avg@4 Full Context (self-reported) | 22 |
Interactive version: theaggregate.ai/model?slug=gemini-2-5-pro-thinking · How It Works · Data refreshed daily, snapshot 2026-08-07.