T5 (11B): benchmark results

Provider: Other. Released 2019-10-23. Access: Open.

Unified ELO 1115 ± 38, rank #2651 of 2656 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BoolQ91.2Accuracy (%)100
Epoch AI - Superglue88.9Score100
RealToxicityPrompts0.01Toxic fraction95.1
Epoch AI - Common Sense Qa 267.8Score83.3
HELM Classic - LegalSupport55.83Exact Match (%)63.2
HELM Classic - BoolQ76.1Exact Match (%)57.6
HELM Classic - Synthetic Reasoning Abstract19.59Exact Match (%)39.7
HELM Classic - MMLU29.03Exact Match (%)36.4
HELM Classic - Synthetic Reasoning Natural10.09F1 (%)32.4
HELM Classic - Entity Matching65.2Exact Match (%)31.8
HELM Classic - GSM8K2.33Exact Match (%)30.9
HELM Classic - NaturalQuestions Closed Book19.38F1 (%)22.7

Interactive version: theaggregate.ai/model?slug=t5-11b · How It Works · Data refreshed daily, snapshot 2026-09-19.