Qwen 2 1.5B — benchmark results

Provider: Alibaba. Released 2024-06-06. Access: Open.

Unified ELO 1301 ± 17, rank #1534 of 1776 rated models, from 76 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Pinocchio Italian - Lingua Straniera72.31Accuracy (%)75
Open Chinese LLM - C-Eval Semantic65.58Accuracy (%)39.8
Open LLM Leaderboard - MATH Level 57.02Score37.5
Open Chinese LLM - CMMLU50.6Accuracy (%)36.8
Open Japanese LLM - Xlsum JA Rouge123.25Score (%)35.6
Open Japanese LLM - Xlsum JA RougeLsum19.65Score (%)34.4
Open Japanese LLM - SUM7.96Score (%)31.7
Open PL LLM - Generative31.26Average Generative Score (%)30.8
Open Japanese LLM - Xlsum JA Bert Score JA F167.44Score (%)30.3
Open Japanese LLM - Xlsum JA Rouge27.96Score (%)30.2
Pinocchio Italian - Logica37.25Accuracy (%)29.5
Pinocchio Italian Leaderboard46.62Average Accuracy (%)29.5

Interactive version: theaggregate.ai/model?slug=qwen-2-1-5b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.