Gemini 2.5 Pro (Thinking) — benchmark results

Provider: Google. Released 2025-06-05. Access: API.

Unified ELO 1728 ± 35, rank #267 of 1806 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMMU Benchmark84Validation Score97.9
SEAL - AudioMultiChallenge - Text Output46.9Score82.4
MMSI-Bench37Accuracy (%)81.6
AudioMC46.9Score (self-reported)81.5
DentalGPT Dental Eval Suite57.9Average Accuracy (self-reported)73.3
ALE-Bench785.52Performance (Self-Refine x1) (self-reported)56.4
VitaBench 2.033.1Avg@4 Full Context (self-reported)22

Interactive version: theaggregate.ai/model?slug=gemini-2-5-pro-thinking · How It Works · Data refreshed daily, snapshot 2026-08-07.