mt0-xxl: benchmark results

Provider: Other. Access: Open.

Unified ELO 1308 ± 17, rank #2430 of 2656 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Greek MMLU56.57Accuracy (%)48.1
Greek MMLU - Social Sciences61.33Accuracy (%)48.1
Greek MMLU - STEM52.72Accuracy (%)46.9
Greek MMLU - Greek-Specific56.91Accuracy (%)45.7
Greek MMLU - Humanities53.13Accuracy (%)40.7
Open Korean LLM - Ko-GPQA-Diamond22.22Normalized accuracy (%)35
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-IFEval22.59Strict accuracy, prompt/instruction mean (%)23.9
Open Korean LLM - Ko-GSM8K (flexible extract)4.25Exact match, flexible extract (%)22.7
Greek MMLU - Other36.92Accuracy (%)22.2
Open Korean LLM - Ko-Winogrande53.43Accuracy (%)12.6
Open Korean LLM Leaderboard28.61Average Score (%)7.2

Interactive version: theaggregate.ai/model?slug=mt0-xxl · How It Works · Data refreshed daily, snapshot 2026-09-19.