Granite 4.1 8B: benchmark results
IBM's Apache-2.0 8B dense Granite 4.1 instruct model (April 2026) with 512K context, matching the prior 32B MoE Granite 4.0-H-Small. Provider: IBM. Released 2026-04-29. Access: Open.
Unified ELO 1491 ± 1, rank #731 of 1392 rated models, from 55 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SpeechMap Compliance | 84 | % Requests Completed | 81.4 |
| AA Omniscience - Software Engineering (SWE) - Kotlin | 18 | Accuracy (%) | 55.3 |
| AA Omniscience - Software Engineering (SWE) - PHP | 22 | Accuracy (%) | 55.3 |
| BLXBench | 64.6 | Score (self-reported) | 54.2 |
| AA Omniscience - Software Engineering (SWE) - Swift | 32 | Accuracy (%) | 51.2 |
| Chatbot Arena (Text - Math) | 1320 | Arena Score | 44.8 |
| AA Omniscience - Software Engineering (SWE) - Rust | 44 | Accuracy (%) | 43 |
| Chatbot Arena (Text - Chinese) | 1358 | Arena Score | 42.6 |
| Chatbot Arena (Text - English) | 1331 | Arena Score | 37.6 |
| Chatbot Arena (Text - Hard Prompts) | 1321 | Arena Score | 37.2 |
| Chatbot Arena (Text - Coding) | 1354 | Arena Score | 36.4 |
| AA Omniscience - Software Engineering (SWE) - HTML | 26 | Accuracy (%) | 36 |
Interactive version: theaggregate.ai/model?slug=granite-4-1-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.