Gemma 4 E4B (Non-reasoning): benchmark results

Provider: Google. Released 2026-04-02. Access: Open.

Unified ELO 1513 ± 1, rank #1282 of 3078 rated models, from 54 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CritPt30Accuracy (self-reported)80.8
AA-Omniscience Hallucination Rate53.77Hallucination Rate (%)78.5
AA-Omniscience Index - Business-28.7Omniscience Index57.3
AA-Omniscience Index - Software Engineering (SWE) - R-42Omniscience Index56.2
AA-Omniscience Index - Law-36.2Omniscience Index55.3
AA-Omniscience Index - Software Engineering (SWE) - Java-48Omniscience Index53.1
AA CritPt0.29Accuracy (%)52.3
AA-Omniscience Index - Health-41.1Omniscience Index50
AA-Omniscience Index - Software Engineering (SWE) - Go-40Omniscience Index49.4
AA-Omniscience Index - Software Engineering (SWE) - Julia-56Omniscience Index47.6
AA-Omniscience Index - Software Engineering (SWE) - Python-42Omniscience Index46.8
AA Omniscience-40.98Score45.8

Interactive version: theaggregate.ai/model?slug=gemma-4-e4b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.