mt0-xl: benchmark results

Provider: Other. Access: Open.

Unified ELO 1270 ± 17, rank #2541 of 2656 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Greek MMLU - Other52.51Accuracy (%)44.4
Greek MMLU - Social Sciences54.21Accuracy (%)42
Greek MMLU - Greek-Specific52.24Accuracy (%)39.5
Greek MMLU49.96Accuracy (%)35.8
Greek MMLU - Humanities47.88Accuracy (%)33.3
Greek MMLU - STEM46.44Accuracy (%)30.9
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-GPQA-Diamond21.21Normalized accuracy (%)24
Open Korean LLM - Ko-IFEval19.19Strict accuracy, prompt/instruction mean (%)15.4
Open Korean LLM - Ko-GSM8K (flexible extract)1.52Exact match, flexible extract (%)13.9
Open Korean LLM - Ko-Winogrande51.3Accuracy (%)6.1
Open Korean LLM - KorNAT-Helpful39.1Normalized accuracy (%)4.5

Interactive version: theaggregate.ai/model?slug=mt0-xl · How It Works · Data refreshed daily, snapshot 2026-09-19.