Granite 4.1 3B: benchmark results

IBM's 3B dense decoder-only model from the Apache-2.0 Granite 4.1 family (April 2026), trained on ~15T tokens with context extension up to 512K. Provider: IBM. Released 2026-04-29. Access: Open.

Unified ELO 1416 ± 1, rank #1287 of 1761 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Dart16Accuracy (%)43.7
AA Omniscience - Software Engineering (SWE) - JavaScript24.77Accuracy (%)40.3
AA Omniscience - Software Engineering (SWE) - PHP16Accuracy (%)35
AA Omniscience - Software Engineering (SWE) - Java12Accuracy (%)33.1
AA Omniscience - Software Engineering (SWE) - Kotlin12Accuracy (%)31.7
AA Omniscience - Software Engineering (SWE) - Julia4Accuracy (%)30.4
AA Omniscience - Software Engineering (SWE) - TypeScript10Accuracy (%)24.6
AA CritPt0Accuracy (%)24.4
AA IFBench33.67Accuracy (%)23.6
AA Omniscience - Software Engineering (SWE) - Rust36Accuracy (%)21.7
AA Terminal-Bench Hard2.27Accuracy (%)19.6
AA TAU-2 Bench19.59Accuracy (%)18.2

Interactive version: theaggregate.ai/model?slug=granite-4-1-3b · How It Works · Data refreshed daily, snapshot 2026-09-05.