EZO-Qwen2.5-32B-Instruct — benchmark results

Axcxept's Japanese-focused instruction tune of Qwen2.5 32B Instruct, trained on curated Japanese Wikipedia and FineWeb data. Provider: Other. Released 2024-09-21. Access: Open.

Unified ELO 1538 ± 14, rank #654 of 1776 rated models, from 173 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Arabic MMLU HT Moral Scenarios58.55Accuracy (%)98.8
Open Japanese LLM - Jsts Spearman88.23Score (%)96.6
Open Japanese LLM - Jcommonsenseqa Exact Match96.25Score (%)93.6
Open Arabic LLM - Aratrust Offensive94.2Accuracy (%)93.5
Open Japanese LLM - Jsick Exact Match85.51Score (%)93.4
Open Arabic LLM - Arabic MMLU History (Primary School)72.55Accuracy (%)92
Open Arabic LLM - Arabic MMLU Islamic Studies (High School)75.15Accuracy (%)92
Open Arabic LLM - Aratrust Unfairness94.55Accuracy (%)91
Open Arabic LLM - Aratrust Average89.15Accuracy (%)90.7
Open Japanese LLM - NLI80.95Score (%)90.6
Open Arabic LLM - Arabic MMLU Economics (High School)69.72Accuracy (%)90.4
Open Arabic LLM - Aratrust Privacy96.49Accuracy (%)90.4

Interactive version: theaggregate.ai/model?slug=ezo-qwen2-5-32b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.