Qwen2.5-Math-7B-CFT — benchmark results
Provider: Alibaba. Released 2025-01-30. Access: Open.
Unified ELO 1332 ± 14, rank #1467 of 1776 rated models, from 179 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MATH Level 5 | 55.74 | Score | 99.3 |
| Open Arabic LLM - Arabic MMLU Civics (High School) | 47.13 | Accuracy (%) | 73.8 |
| Open Japanese LLM - MR | 82.2 | Score (%) | 49.5 |
| Open Arabic LLM - Madinah QA Arabic Language (Grammar) | 30.68 | Accuracy (%) | 41 |
| Open LLM Leaderboard - GPQA | 4.81 | Score | 41 |
| Open LLM Leaderboard - BBH | 24.59 | Score | 37.7 |
| Open Japanese LLM - Wiki Coreference SET F1 | 1.61 | Score (%) | 35.7 |
| Open LLM Leaderboard - MMLU-Pro | 21.61 | Score | 34.7 |
| Open Japanese LLM - Jsem Exact Match | 71.97 | Score (%) | 31.6 |
| Open LLM Leaderboard - MuSR | 6.62 | Score | 31.4 |
| Open Japanese LLM - Jmmlu Exact Match | 47.59 | Score (%) | 30.4 |
| Open Arabic LLM - Arabic MMLU Math (Primary School) | 42.05 | Accuracy (%) | 29.3 |
Interactive version: theaggregate.ai/model?slug=qwen2-5-math-7b-cft · How the rankings work · Data refreshed daily, snapshot 2026-07-22.