Gemma 4 12B (IT): benchmark results
Provider: Google. Released 2026-04-02. Access: Open.
Unified ELO 1582 ± 1, rank #357 of 1553 rated models, from 24 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SEA-HELM (English) | 58.3 | Mean Score | 88.4 |
| SEA-HELM (Burmese) | 58.07 | Mean Score | 86 |
| SEA-HELM (Indonesian) | 72.83 | Mean Score | 83.7 |
| Enkrypt AI - Insecure Code Risk | 10.22 | Risk Score | 82.6 |
| SEA-HELM (Thai) | 66.7 | Mean Score | 81.4 |
| SEA-HELM (Malay) | 70.18 | Mean Score | 79.1 |
| Arabic Broad Leaderboard | 8.77 | Average Score (0-10) | 74.5 |
| SEA-HELM (Filipino) | 66.78 | Mean Score | 69.8 |
| SEA-HELM (Tamil) | 62.12 | Mean Score | 68.6 |
| Enkrypt AI - Risk Score | 28.38 | Risk Score | 64.8 |
| Metacognition-Bench | 94.7 | Trap Resistance (100 × (1 − trap rate), higher is better) | 64.1 |
| UGI - Natural Intelligence | 25.81 | NatInt Score | 64.1 |
Interactive version: theaggregate.ai/model?slug=gemma-4-12b-it · How It Works · Data refreshed daily, snapshot 2026-09-08.