Qwen2-Math-7B-Instruct: benchmark results
Provider: Alibaba. Released 2024-08-08. Access: Open.
Unified ELO 1418 ± 48, rank #1765 of 2656 rated models, from 25 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Omni-MATH | 29.36 | Overall Accuracy (%) | 57.1 |
| MERA - LCS | 12.4 | Accuracy (%) | 47.6 |
| MERA - MathLogicQA | 43.13 | Accuracy (%) | 41.4 |
| MERA - RWSD | 53.46 | Accuracy (%) | 37.8 |
| MERA - ruHateSpeech | 62.64 | Accuracy (%) | 32.5 |
| MERA - ruModAr | 46.1 | EM (%) | 29.3 |
| MERA - ruMultiAr | 23.63 | EM (%) | 28.7 |
| MERA - BPS | 84.8 | Accuracy (%) | 27.8 |
| MERA - PARus | 63.2 | Accuracy (%) | 25.2 |
| MERA - RCB | 47.72 | Accuracy (%) | 23.9 |
| Wolfram LLM Benchmarking Project | 24.1 | Correct Functionality (%) | 22.1 |
| MERA - ruTiE | 56.2 | Accuracy (%) | 22 |
Interactive version: theaggregate.ai/model?slug=qwen2-math-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-19.