Gemma 4 26B A4B (Reasoning): benchmark results
Provider: Google. Released 2026-04-02. Access: Open.
Unified ELO 1584 ± 1, rank #713 of 3078 rated models, from 55 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA IFBench | 72.45 | Accuracy (%) | 89.3 |
| AA Omniscience - Software Engineering (SWE) - Swift | 48 | Accuracy (%) | 82.4 |
| AA Omniscience - Software Engineering (SWE) - Dart | 24 | Accuracy (%) | 72.2 |
| AA Humanity's Last Exam | 19.32 | Accuracy (%) | 70.2 |
| AA GPQA Diamond | 79.19 | Accuracy (%) | 65.6 |
| AA-Omniscience Index - Software Engineering (SWE) - Swift | 4 | Omniscience Index | 64.5 |
| Artificial Analysis Intelligence Index | 16.67 | Intelligence Index | 64.5 |
| AA Omniscience - Software Engineering (SWE) - R | 12 | Accuracy (%) | 62.1 |
| AA Long Context Reasoning | 65.67 | Accuracy (%) | 60.7 |
| AA Omniscience - Software Engineering (SWE) - PHP | 24 | Accuracy (%) | 60.6 |
| AA Omniscience - Software Engineering (SWE) - C | 35 | Accuracy (%) | 58.4 |
| AA Omniscience - Software Engineering (SWE) - Java | 16 | Accuracy (%) | 57 |
Interactive version: theaggregate.ai/model?slug=gemma-4-26b-a4b-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.