Qwen 2 1.5B: benchmark results

Provider: Alibaba. Released 2024-06-06. Access: Open.

Unified ELO 1350 ± 1, rank #1268 of 1392 rated models, from 99 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Pinocchio Italian - Lingua Straniera72.31Accuracy (%)75
Open Chinese LLM - C-Eval Semantic65.58Accuracy (%)39.8
MERA - RWSD54.23Accuracy (%)39.5
Open LLM Leaderboard - MATH Level 57.02Score37.5
Open Chinese LLM - CMMLU50.6Accuracy (%)36.8
Open Japanese LLM - Xlsum JA Rouge123.25Score (%)36.3
Open Japanese LLM - Xlsum JA RougeLsum19.65Score (%)35.1
MERA - ruHumanEval3.78pass@1 (%)33.7
Open Japanese LLM - Xlsum JA Rouge27.96Score (%)31.9
Open Japanese LLM - SUM7.96Score (%)31.7
Open PL LLM - Generative31.26Average Generative Score (%)30.8
Open Japanese LLM - Xlsum JA Bert Score JA F167.44Score (%)30.3

Interactive version: theaggregate.ai/model?slug=qwen-2-1-5b · How It Works · Data refreshed daily, snapshot 2026-09-05.