Tri-21B-Think — benchmark results

Trillion Labs' open 21B Korean reasoning model (February 2026), the full release with backtracking chain-of-thought that runs on a single GPU. Provider: Trillion Labs. Released 2026-02-10. Access: Open.

Unified ELO 1539 ± 41, rank #651 of 1776 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench80.99Accuracy (%)71.5
AA IFBench54.63Accuracy (%)65.7
CritPt0.3Accuracy (self-reported)65
AA CritPt0.29Accuracy (%)58.7
AA Humanity's Last Exam6.12Accuracy (%)45.1
Artificial Analysis Intelligence Index12.36Intelligence Index42.1
AA GPQA Diamond60.1Accuracy (%)38.3
AA Omniscience - Software Engineering (SWE) - HTML26Accuracy (%)34.9
AA Omniscience - Software Engineering (SWE) - Rust42Accuracy (%)32.4
AA Omniscience - Software Engineering (SWE) - Kotlin12Accuracy (%)31.1
AA Omniscience - Software Engineering (SWE) - R6Accuracy (%)30.9
AA-LCR11Score (self-reported)29.1

Interactive version: theaggregate.ai/model?slug=tri-21b-think · How the rankings work · Data refreshed daily, snapshot 2026-07-22.