Gemma 4 31B — benchmark results

Google's flagship dense Gemma 4 31B open model. Provider: Google. Released 2026-04-02. Access: Open.

Unified ELO 1585 ± 15, rank #514 of 1776 rated models, from 402 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BIG-Bench Extra Hard74.4Score (self-reported)100
Codeforces ELO2150ELO (self-reported)100
Momento78.26Pass@k (self-reported)100
SEA-HELM75.16Mean Score (%)100
TeleResilienceBench29.1Macro Average CFR (self-reported)100
TuRTLe Spec-to-RTL (Icarus Verilog)81.51Aggregated Score (self-reported)100
TuRTLe Spec-to-RTL (Verilator)79.83Aggregated Score (self-reported)100
Kaggle FACTS Grounding80.67Score (%)97.4
Agent Arena14.51Net Improvement (%)97.3
Agent Arena - Bash Recovery33.53Bash Recovery (%)97.3
ReasonScape R12927.77ReasonScore95.5
TuRTLe Code Completion (Icarus Verilog)82.57Aggregated Score (self-reported)95.3

Interactive version: theaggregate.ai/model?slug=gemma-4-31b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.