flan-t5-xxl — benchmark results

Provider: Google. Released 2022-10-21. Access: API.

Unified ELO 1336 ± 43, rank #1454 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ConvRe - Text2Re Easy96.8Accuracy (%)100
CMMMU (Validation)36.8Validation Overall (%)79.4
CMMMU31.2Test Overall (%)58.8
CyberMetric72.38Accuracy (%)58.3
Open LLM Leaderboard - MuSR11.19Score58
Open LLM Leaderboard - BBH30.12Score52.2
ConvRe - Re2Text Easy79.4Accuracy (%)33.3
ConvRe - Re2Text Hard20.7Accuracy (%)33.3
Open LLM Leaderboard - GPQA2.68Score24.8
Open LLM Leaderboard - MMLU-Pro14.92Score24
Open LLM Leaderboard - IFEval22Score15
ConvRe50.4Average Score (%)11.1

Interactive version: theaggregate.ai/model?slug=flan-t5-xxl · How the rankings work · Data refreshed daily, snapshot 2026-07-22.