flan-t5-large — benchmark results

Provider: Google. Released 2022-10-21. Access: API.

Unified ELO 1217 ± 42, rank #1670 of 1776 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ConvRe - Re2Text Hard26.2Accuracy (%)44.4
ConvRe - Text2Re Hard29.6Accuracy (%)44.4
Open LLM Leaderboard - MuSR9.01Score43.5
ConvRe51.2Average Score (%)33.3
ConvRe - Text2Re Easy77.3Accuracy (%)33.3
Open LLM Leaderboard - BBH17.51Score26.3
ConvRe - Re2Text Easy71.5Accuracy (%)22.2
Open LLM Leaderboard - MMLU-Pro7.88Score18.2
Open LLM Leaderboard - IFEval22.01Score15
Open LLM Leaderboard - MATH Level 51.44Score10.6
Open LLM Leaderboard - GPQA0.11Score5.5

Interactive version: theaggregate.ai/model?slug=flan-t5-large · How the rankings work · Data refreshed daily, snapshot 2026-07-22.