Gemini 2.5 Pro (Thinking): benchmark results

Provider: Google. Released 2025-06-05. Access: API.

Unified ELO 1649 ± 1, rank #350 of 3081 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMMU Benchmark84Validation Score97.9
DocHop40.6Accuracy (%)94.7
OenoBench (Expert)69.4Accuracy (%, L4 expert tier)93.3
SEAL - AudioMultiChallenge - Text Output46.9Score82.4
MMSI-Bench37Accuracy (%)81.6
AudioMC46.9Score (self-reported)81.5
DentalGPT Dental Eval Suite57.9Average Accuracy (self-reported)75
ALE-Bench785.52Performance (Self-Refine x1) (self-reported)52.3
VitaBench 2.033.1Avg@4 Full Context (self-reported)30.7

Interactive version: theaggregate.ai/model?slug=gemini-2-5-pro-thinking · How It Works · Data refreshed daily, snapshot 2026-09-21.