Tri-21B-Think Preview — benchmark results

Preview of Trillion Labs' 21B RL-trained reasoning model with a backtracking mechanism (February 2026). Provider: Trillion Labs. Released 2026-02-10. Access: Open.

Unified ELO 1562 ± 57, rank #586 of 1776 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench93.27Accuracy (%)90
AA IFBench47.14Accuracy (%)55.4
Artificial Analysis Intelligence Index13.62Intelligence Index45.6
AA Humanity's Last Exam5.75Accuracy (%)41.9
AA Omniscience - Software Engineering (SWE) - Julia8Accuracy (%)37.3
AA-LCR14.7Score (self-reported)33.6
AA GPQA Diamond53.84Accuracy (%)30.8
CritPt0Accuracy (self-reported)30.3
AA Omniscience - Software Engineering (SWE) - PHP16Accuracy (%)28.8
AA Omniscience - Software Engineering (SWE) - Swift28Accuracy (%)28
AA Omniscience-55.28Score27.7
AA CritPt0Accuracy (%)27.1

Interactive version: theaggregate.ai/model?slug=tri-21b-think-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.