Gemma 4 E4B: benchmark results
Provider: Google. Released 2026-04-02. Access: Open.
Unified ELO 1461 ± 1, rank #893 of 1392 rated models, from 304 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Managing Procedural Memory in LLM Agents | 3 | size (self-reported) | 95.8 |
| POLAR-Bench | 90.87 | Overall Mean (self-reported) | 85.7 |
| P3B3 | 94.4 | LLM pt-PT (↑) (self-reported) | 84.2 |
| MathVision | 59.5 | Overall Accuracy (%) | 73.8 |
| SEA-HELM | 62.55 | Mean Score (%) | 69.8 |
| EuroEval Lithuanian NLU - MultiWikiQA LT | 60.71 | Reading comprehension Score (%) | 67.7 |
| EuroEval Bulgarian NLU - Cinexio | 40.53 | Sentiment classification Score (%) | 67.3 |
| EuroEval Ukrainian NLU - MultiWikiQA UK | 57.72 | Reading comprehension Score (%) | 67.2 |
| EuroEval Albanian NLU - MultiWikiQA SQ | 55.2 | Reading comprehension Score (%) | 64.6 |
| EuroEval Bosnian NLU - Multi Wiki QA BS | 63.61 | Reading comprehension Score (%) | 59.5 |
| EuroEval Greek NLU - MultiWikiQA EL | 60.35 | Reading comprehension Score (%) | 59.1 |
| EuroEval Bulgarian NLU - MultiWikiQA BG | 66.35 | Reading comprehension Score (%) | 58.3 |
Interactive version: theaggregate.ai/model?slug=gemma-4-e4b · How It Works · Data refreshed daily, snapshot 2026-09-05.