Gemma 4 26B A4B (Non-reasoning): benchmark results

Provider: Google. Released 2026-04-02. Access: Open.

Unified ELO 1520 ± 1, rank #869 of 2032 rated models, from 56 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ObGynLongBench - Evidence-Only78.2Accuracy (%; supporting evidence only)87.5
ObGynLongBench - History-Level EHR - L1 Single Evidence65Accuracy (%)81.2
ObGynLongBench - Visit-Level EHR60.6Accuracy (%; same-day visit records)81.2
AA Omniscience - Software Engineering (SWE) - PHP28Accuracy (%)69.1
ObGynLongBench - History-Level EHR60.7Accuracy (%; full pre-decision EHR history)68.8
ObGynLongBench - History-Level EHR - L2 Multi-Source Integration61.4Accuracy (%)68.8
AA Terminal-Bench Hard25Accuracy (%)66
AA Omniscience - Software Engineering (SWE) - Rust50Accuracy (%)59
AA Humanity's Last Exam11.49Accuracy (%)56.9
AA Omniscience - Software Engineering (SWE) - Go18Accuracy (%)56.5
Artificial Analysis Intelligence Index13.13Intelligence Index54.3
AA Omniscience - Software Engineering (SWE) - JavaScript28.18Accuracy (%)52.9

Interactive version: theaggregate.ai/model?slug=gemma-4-26b-a4b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-26.