Gemma 4 E4B (Non-reasoning): benchmark results
Provider: Google. Released 2026-04-02. Access: Open.
Unified ELO 1513 ± 1, rank #1282 of 3078 rated models, from 54 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CritPt | 30 | Accuracy (self-reported) | 80.8 |
| AA-Omniscience Hallucination Rate | 53.77 | Hallucination Rate (%) | 78.5 |
| AA-Omniscience Index - Business | -28.7 | Omniscience Index | 57.3 |
| AA-Omniscience Index - Software Engineering (SWE) - R | -42 | Omniscience Index | 56.2 |
| AA-Omniscience Index - Law | -36.2 | Omniscience Index | 55.3 |
| AA-Omniscience Index - Software Engineering (SWE) - Java | -48 | Omniscience Index | 53.1 |
| AA CritPt | 0.29 | Accuracy (%) | 52.3 |
| AA-Omniscience Index - Health | -41.1 | Omniscience Index | 50 |
| AA-Omniscience Index - Software Engineering (SWE) - Go | -40 | Omniscience Index | 49.4 |
| AA-Omniscience Index - Software Engineering (SWE) - Julia | -56 | Omniscience Index | 47.6 |
| AA-Omniscience Index - Software Engineering (SWE) - Python | -42 | Omniscience Index | 46.8 |
| AA Omniscience | -40.98 | Score | 45.8 |
Interactive version: theaggregate.ai/model?slug=gemma-4-e4b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.