Gemini 3.1 Pro (Preview) (Medium): benchmark results

Provider: Google. Released 2026-02-19. Access: API.

Unified ELO 1719 ± 1, rank #91 of 3078 rated models, from 29 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chess Bench LLM2010Lichess Rating99.2
Context Arena MRCR (8-needle)48.5AUC@1M (%)97.7
ObviousBench100Answer pass³ (%)97.7
Conceptual Reasoning Index - Decision Theory (DTBench)95.12Chance-Corrected Score (0-100)95.6
Context Arena MRCR (2-needle)87.7AUC@1M (%)95
BeQu - Experiment 1 - Entailment Precision79.2Entailment Precision (%)94.7
NOLLI - Jamo Composition57.3Accuracy (%)92.9
GIM1.85IRT ability (theta)91.1
Context Arena MRCR (4-needle)62.8AUC@1M (%)90.2
OckBench87.5Accuracy (%)86.4
NOLLI - Average73.6Accuracy (%; 25-task macro average)85.7
NOLLI - Cipher - English84.7Accuracy (%)85.7

Interactive version: theaggregate.ai/model?slug=gemini-3-1-pro-preview-medium · How It Works · Data refreshed daily, snapshot 2026-09-19.