Qwen 1.5 4B — benchmark results

Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1359 ± 13, rank #1384 of 1776 rated models, from 205 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Xlsum JA Bleu JA62.09Score (%)98.1
Open Arabic LLM - Aratrust Offensive89.86Accuracy (%)80.7
Open Chinese LLM - WinoGrande63.85Accuracy (%)61.9
EuroEval Danish Knowledge38.12Knowledge Average Score (%)41.2
EuroEval Norwegian Common Sense Reasoning35.96Common Sense Reasoning Average Score (%)40.9
Open Chinese LLM - C-Eval Semantic66.37Accuracy (%)40.4
EuroEval Dutch NLU - DBRD83.66Sentiment classification Score (%)39
Open Arabic LLM - Arabic MMLU HT Medical Genetics41Accuracy (%)38.9
Open Arabic LLM - Arabic MMLU Management (University)64Accuracy (%)38.6
EuroEval Portuguese NLU - ScaLA PT7.06Linguistic acceptability Score (%)38.2
Open Arabic LLM - Arabic MMLU Computer Science (Primary School)60Accuracy (%)38
EuroEval English Knowledge62.85Knowledge Average Score (%)37.9

Interactive version: theaggregate.ai/model?slug=qwen-1-5-4b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.