Qwen 2 1.5B — benchmark results
Provider: Alibaba. Released 2024-06-06. Access: Open.
Unified ELO 1301 ± 17, rank #1534 of 1776 rated models, from 76 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Pinocchio Italian - Lingua Straniera | 72.31 | Accuracy (%) | 75 |
| Open Chinese LLM - C-Eval Semantic | 65.58 | Accuracy (%) | 39.8 |
| Open LLM Leaderboard - MATH Level 5 | 7.02 | Score | 37.5 |
| Open Chinese LLM - CMMLU | 50.6 | Accuracy (%) | 36.8 |
| Open Japanese LLM - Xlsum JA Rouge1 | 23.25 | Score (%) | 35.6 |
| Open Japanese LLM - Xlsum JA RougeLsum | 19.65 | Score (%) | 34.4 |
| Open Japanese LLM - SUM | 7.96 | Score (%) | 31.7 |
| Open PL LLM - Generative | 31.26 | Average Generative Score (%) | 30.8 |
| Open Japanese LLM - Xlsum JA Bert Score JA F1 | 67.44 | Score (%) | 30.3 |
| Open Japanese LLM - Xlsum JA Rouge2 | 7.96 | Score (%) | 30.2 |
| Pinocchio Italian - Logica | 37.25 | Accuracy (%) | 29.5 |
| Pinocchio Italian Leaderboard | 46.62 | Average Accuracy (%) | 29.5 |
Interactive version: theaggregate.ai/model?slug=qwen-2-1-5b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.