EZO-Qwen2.5-32B-Instruct — benchmark results
Axcxept's Japanese-focused instruction tune of Qwen2.5 32B Instruct, trained on curated Japanese Wikipedia and FineWeb data. Provider: Other. Released 2024-09-21. Access: Open.
Unified ELO 1538 ± 14, rank #654 of 1776 rated models, from 173 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Arabic LLM - Arabic MMLU HT Moral Scenarios | 58.55 | Accuracy (%) | 98.8 |
| Open Japanese LLM - Jsts Spearman | 88.23 | Score (%) | 96.6 |
| Open Japanese LLM - Jcommonsenseqa Exact Match | 96.25 | Score (%) | 93.6 |
| Open Arabic LLM - Aratrust Offensive | 94.2 | Accuracy (%) | 93.5 |
| Open Japanese LLM - Jsick Exact Match | 85.51 | Score (%) | 93.4 |
| Open Arabic LLM - Arabic MMLU History (Primary School) | 72.55 | Accuracy (%) | 92 |
| Open Arabic LLM - Arabic MMLU Islamic Studies (High School) | 75.15 | Accuracy (%) | 92 |
| Open Arabic LLM - Aratrust Unfairness | 94.55 | Accuracy (%) | 91 |
| Open Arabic LLM - Aratrust Average | 89.15 | Accuracy (%) | 90.7 |
| Open Japanese LLM - NLI | 80.95 | Score (%) | 90.6 |
| Open Arabic LLM - Arabic MMLU Economics (High School) | 69.72 | Accuracy (%) | 90.4 |
| Open Arabic LLM - Aratrust Privacy | 96.49 | Accuracy (%) | 90.4 |
Interactive version: theaggregate.ai/model?slug=ezo-qwen2-5-32b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.