Gemini 2.5 Pro (Preview 05-06) — benchmark results
May 6 Gemini 2.5 Pro preview snapshot. Provider: Google. Released 2025-05-06. Access: API.
Unified ELO 1702 ± 15, rank #266 of 1776 rated models, from 113 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CodeGolf Bench | 73.9 | C++ Best %ile (self-reported) | 100 |
| HELM MedHELM - MEDIQA | 4.97 | Jury Score | 100 |
| HELM MedHELM - MedicationQA | 4.84 | Jury Score | 100 |
| HELM MedHELM - PubMedQA | 76.4 | EM | 100 |
| JEE/NEET LLM Benchmark - JEE Advanced 2025 | 89.72 | Exam Score (%) | 100 |
| ResearchCodeBench | 64.2 | Task Success Rate (%) | 100 |
| TRAIL GAIA | 18.3 | Joint Accuracy | 100 |
| TRAIL SWE | 5 | Joint Accuracy | 100 |
| KOFFVQA - Document Understanding | 100 | Score (%) | 98.1 |
| KOFFVQA - Table Understanding | 96.67 | Score (%) | 98.1 |
| KOFFVQA | 88.98 | Overall Score (%) | 97.5 |
| KOFFVQA - Graph and Chart Understanding | 91.33 | Score (%) | 97.5 |
Interactive version: theaggregate.ai/model?slug=gemini-2-5-pro-preview-05-06 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.