Gemma 4 E4B: benchmark results

Provider: Google. Released 2026-04-02. Access: Open.

Unified ELO 1461 ± 1, rank #893 of 1392 rated models, from 304 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Managing Procedural Memory in LLM Agents3size (self-reported)95.8
POLAR-Bench90.87Overall Mean (self-reported)85.7
P3B394.4LLM pt-PT (↑) (self-reported)84.2
MathVision59.5Overall Accuracy (%)73.8
SEA-HELM62.55Mean Score (%)69.8
EuroEval Lithuanian NLU - MultiWikiQA LT60.71Reading comprehension Score (%)67.7
EuroEval Bulgarian NLU - Cinexio40.53Sentiment classification Score (%)67.3
EuroEval Ukrainian NLU - MultiWikiQA UK57.72Reading comprehension Score (%)67.2
EuroEval Albanian NLU - MultiWikiQA SQ55.2Reading comprehension Score (%)64.6
EuroEval Bosnian NLU - Multi Wiki QA BS63.61Reading comprehension Score (%)59.5
EuroEval Greek NLU - MultiWikiQA EL60.35Reading comprehension Score (%)59.1
EuroEval Bulgarian NLU - MultiWikiQA BG66.35Reading comprehension Score (%)58.3

Interactive version: theaggregate.ai/model?slug=gemma-4-e4b · How It Works · Data refreshed daily, snapshot 2026-09-05.