byt5-xxl: benchmark results

Provider: Other. Access: Open.

Unified ELO 1344 ± 18, rank #2266 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond27.27Normalized accuracy (%)92.4
Open Korean LLM - Ko-IFEval27.3Strict accuracy, prompt/instruction mean (%)42.4
Open Korean LLM - KorNAT-Helpful45.02Normalized accuracy (%)33.9
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM Leaderboard30.6Average Score (%)20.3
Open Ko-LLM Leaderboard30.6Average (%)20.1
Open Korean LLM - Ko-Winogrande54.3Accuracy (%)15.6
Open Korean LLM - Ko-GSM8K (flexible extract)0.76Exact match, flexible extract (%)10.3
Open Korean LLM - KorNAT-CKA13.76Normalized accuracy (%)4.9
Open Korean LLM - KorNAT-Harmless57.22Normalized accuracy (%)1.7

Interactive version: theaggregate.ai/model?slug=byt5-xxl · How It Works · Data refreshed daily, snapshot 2026-09-19.