Gemini 3 Pro: benchmark results

Google's Pro-tier Gemini 3 model for advanced reasoning and general tasks. Provider: Google. Released 2025-11-18. Access: API.

Unified ELO 1716 ± 1, rank #34 of 1392 rated models, from 295 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ADBench83Pass@3 (self-reported)100
AISE-Bench56.06F1-LM (%)100
BALROG MiniHack (LLM)40Progress (%)100
BALROG NetHack (LLM)6.8Progress (%)100
BacktestBench67.41Overall Accuracy (OA) (self-reported)100
Chatbot Arena (Text - German)1522Arena Score100
Chatbot Arena (Vision - Creative Writing)1324Arena Score100
Chatbot Arena (Vision - Entity Recognition)1298Arena Score100
CreditCardQA70.5Chain-of-Thought Accuracy (%)100
DiffCap-Bench83.1F1* (self-reported)100
Diplomacy: Overall Performance60.3Score100
EmoBench-M70.5Average Score100

Interactive version: theaggregate.ai/model?slug=gemini-3-pro · How It Works · Data refreshed daily, snapshot 2026-09-05.