Falcon-H1R-7B: benchmark results

TII's 7B hybrid Transformer-Mamba2 reasoning model with a 256K context (January 2026). Provider: TII. Released 2026-01-06. Access: Open.

Unified ELO 1524 ± 1, rank #575 of 1392 rated models, from 42 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CritPt30Accuracy (self-reported)80.8
AA LiveCodeBench72.38Pass@1 (%)77.5
AA AIME 202580Accuracy (%)73.3
AA IFBench54.42Accuracy (%)65.3
MathArena - SMT 202585.85Accuracy (%)60.7
AA Humanity's Last Exam10.98Accuracy (%)57.1
MathArena - HMMT Feb 202584.17Accuracy (%)56.8
MathArena - AIME 202586.67Accuracy (%)54.9
AA CritPt0.29Accuracy (%)53.2
AA Omniscience - Software Engineering (SWE) - Swift32Accuracy (%)51.2
AA Omniscience - Software Engineering (SWE) - JavaScript27.27Accuracy (%)48.3
AA Omniscience - Software Engineering (SWE) - Julia8Accuracy (%)46.1

Interactive version: theaggregate.ai/model?slug=falcon-h1r-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.