Tri-21B-Think: benchmark results

Trillion Labs' open 21B Korean reasoning model (February 2026), the full release with backtracking chain-of-thought that runs on a single GPU. Provider: Trillion Labs. Released 2026-02-10. Access: Open.

Unified ELO 1500 ± 1, rank #849 of 1761 rated models, from 32 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CritPt30Accuracy (self-reported)80.8
AA TAU-2 Bench80.99Accuracy (%)71.5
AA IFBench54.63Accuracy (%)65.6
AA CritPt0.29Accuracy (%)53.2
AA Omniscience - Software Engineering (SWE) - HTML30Accuracy (%)51.7
AA Omniscience - Software Engineering (SWE) - Kotlin14Accuracy (%)39.8
Artificial Analysis Intelligence Index6.55Intelligence Index39.2
AA Humanity's Last Exam5.93Accuracy (%)38.5
AA Omniscience - Software Engineering (SWE) - R6Accuracy (%)36.2
AA Omniscience - Software Engineering (SWE) - TypeScript13.33Accuracy (%)36.2
AA GPQA Diamond60.1Accuracy (%)35
AA Omniscience - Software Engineering (SWE) - Java12Accuracy (%)33.1

Interactive version: theaggregate.ai/model?slug=tri-21b-think · How It Works · Data refreshed daily, snapshot 2026-09-05.