jamba-large-1.7 — benchmark results

AI21's hybrid SSM-Transformer MoE (398B total/94B active) with a 256K context, updated for better grounding and instruction-following (July 2025). Provider: AI21 Labs. Released 2025-07-01. Access: API.

Unified ELO 1562 ± 12, rank #584 of 1776 rated models, from 323 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - fig_qa2.44Dataset z-score98.8
AGC-Bench - story_generation_rocstories2.32Dataset z-score97.6
UGI Leaderboard52.21UGI Score93.6
AGC-Bench - twistlist1.43Dataset z-score92.7
AGC-Bench - c3_crosstalk1.07Dataset z-score90.2
AGC-Bench - metaphor_generation1.05Dataset z-score90.2
Evals for Every Language - Language co100Average Score (%)89.6
AGC-Bench - science_analogies0.89Dataset z-score86.2
Evals for Every Language - Language yua86.67Average Score (%)85.8
UGI - Natural Intelligence36.65NatInt Score85.7
AGC-Bench - outline_to_story1.02Dataset z-score82.7
Evals for Every Language - Language zh66.73Average Score (%)81.2

Interactive version: theaggregate.ai/model?slug=jamba-large-1-7 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.