EZO-Qwen2.5-32B-Instruct: benchmark results

Axcxept's Japanese-focused instruction tune of Qwen2.5 32B Instruct, trained on curated Japanese Wikipedia and FineWeb data. Provider: Other. Released 2024-09-21. Access: Open.

Unified ELO 1569 ± 1, rank #369 of 1392 rated models, from 173 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Arabic MMLU HT Moral Scenarios58.55Accuracy (%)98.8
Open Japanese LLM - Jsts Spearman88.23Score (%)96.6
Open Japanese LLM - Jcommonsenseqa Exact Match96.25Score (%)93.6
Open Arabic LLM - Aratrust Offensive94.2Accuracy (%)93.5
Open Japanese LLM - Jsick Exact Match85.51Score (%)93.4
Open Arabic LLM - Arabic MMLU History (Primary School)72.55Accuracy (%)92
Open Arabic LLM - Arabic MMLU Islamic Studies (High School)75.15Accuracy (%)92
Open Arabic LLM - Aratrust Unfairness94.55Accuracy (%)91
Open Arabic LLM - Aratrust Average89.15Accuracy (%)90.7
Open Japanese LLM - NLI80.95Score (%)90.6
Open Arabic LLM - Arabic MMLU Economics (High School)69.72Accuracy (%)90.4
Open Arabic LLM - Aratrust Privacy96.49Accuracy (%)90.4

Interactive version: theaggregate.ai/model?slug=ezo-qwen2-5-32b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.