Qwen 1.5 4B: benchmark results

Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1372 ± 1, rank #1214 of 1392 rated models, from 228 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Aratrust Offensive89.86Accuracy (%)80.7
MERA - RWSD58.46Accuracy (%)62.4
Open Chinese LLM - WinoGrande63.85Accuracy (%)61.9
EuroEval Danish Knowledge38.12Knowledge Average Score (%)41.2
EuroEval Norwegian Common Sense Reasoning35.96Common Sense Reasoning Average Score (%)40.9
Open Chinese LLM - C-Eval Semantic66.37Accuracy (%)40.4
EuroEval Dutch NLU - DBRD83.66Sentiment classification Score (%)39
Open Arabic LLM - Arabic MMLU HT Medical Genetics41Accuracy (%)38.9
Open Arabic LLM - Arabic MMLU Management (University)64Accuracy (%)38.6
EuroEval Portuguese NLU - ScaLA PT7.06Linguistic acceptability Score (%)38.2
Open Arabic LLM - Arabic MMLU Computer Science (Primary School)60Accuracy (%)38
EuroEval English Knowledge62.85Knowledge Average Score (%)37.9

Interactive version: theaggregate.ai/model?slug=qwen-1-5-4b · How It Works · Data refreshed daily, snapshot 2026-09-05.