Jamba Reasoning 3B — benchmark results

AI21's Apache-2.0 3B reasoning model (October 2025) using the hybrid SSM-Transformer Jamba architecture, running 250K+ token contexts on-device. Provider: AI21 Labs. Released 2025-10-08. Access: Open.

Unified ELO 1399 ± 30, rank #1230 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA IFBench52.45Accuracy (%)62.7
CritPt0Accuracy (self-reported)30.3
AA Omniscience - Software Engineering (SWE) - PHP16Accuracy (%)28.8
AA CritPt0Accuracy (%)27.1
AA-LCR7Score (self-reported)25.8
AA Humanity's Last Exam4.59Accuracy (%)24.1
AA Omniscience - Software Engineering (SWE) - Julia4Accuracy (%)23.7
AA LiveCodeBench20.95Pass@1 (%)22.1
AA MMLU-Pro57.75Accuracy (%)20.6
AA Long Context Reasoning7Accuracy (%)19.5
AA Omniscience - Software Engineering (SWE) - Swift24Accuracy (%)19.5
AA Omniscience - Software Engineering (SWE) - Go8Accuracy (%)17.5

Interactive version: theaggregate.ai/model?slug=jamba-reasoning-3b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.