Tri-21B-Think Preview — benchmark results
Preview of Trillion Labs' 21B RL-trained reasoning model with a backtracking mechanism (February 2026). Provider: Trillion Labs. Released 2026-02-10. Access: Open.
Unified ELO 1562 ± 57, rank #586 of 1776 rated models, from 33 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA TAU-2 Bench | 93.27 | Accuracy (%) | 90 |
| AA IFBench | 47.14 | Accuracy (%) | 55.4 |
| Artificial Analysis Intelligence Index | 13.62 | Intelligence Index | 45.6 |
| AA Humanity's Last Exam | 5.75 | Accuracy (%) | 41.9 |
| AA Omniscience - Software Engineering (SWE) - Julia | 8 | Accuracy (%) | 37.3 |
| AA-LCR | 14.7 | Score (self-reported) | 33.6 |
| AA GPQA Diamond | 53.84 | Accuracy (%) | 30.8 |
| CritPt | 0 | Accuracy (self-reported) | 30.3 |
| AA Omniscience - Software Engineering (SWE) - PHP | 16 | Accuracy (%) | 28.8 |
| AA Omniscience - Software Engineering (SWE) - Swift | 28 | Accuracy (%) | 28 |
| AA Omniscience | -55.28 | Score | 27.7 |
| AA CritPt | 0 | Accuracy (%) | 27.1 |
Interactive version: theaggregate.ai/model?slug=tri-21b-think-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.