Gemma 4 E4B — benchmark results
Provider: Google. Released 2026-04-02. Access: Open.
Unified ELO 1292 ± 15, rank #1546 of 1776 rated models, from 312 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Managing Procedural Memory in LLM Agents | 3 | size (self-reported) | 95.8 |
| POLAR-Bench | 90.87 | Overall Mean (self-reported) | 85.7 |
| P3B3 | 94.4 | LLM pt-PT (â) (self-reported) | 84.2 |
| BIG-Bench Extra Hard | 33.1 | Score (self-reported) | 73.3 |
| MathVision | 59.5 | Overall Accuracy (%) | 73.3 |
| CritPt | 0.6 | Accuracy (self-reported) | 71.1 |
| SEA-HELM | 62.57 | Mean Score (%) | 69.8 |
| EuroEval Lithuanian NLU - MultiWikiQA LT | 60.71 | Reading comprehension Score (%) | 67.7 |
| EuroEval Bulgarian NLU - Cinexio | 40.53 | Sentiment classification Score (%) | 67.3 |
| EuroEval Ukrainian NLU - MultiWikiQA UK | 57.72 | Reading comprehension Score (%) | 67.2 |
| EuroEval Albanian NLU - MultiWikiQA SQ | 55.2 | Reading comprehension Score (%) | 64.6 |
| AgentFloor | 46 | TCR (self-reported) | 62.5 |
Interactive version: theaggregate.ai/model?slug=gemma-4-e4b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.