Qwen 1.5 0.5B — benchmark results

Provider: Alibaba. Released 2024-02-04. Access: Open.

Unified ELO 1149 ± 27, rank #1736 of 1776 rated models, from 112 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Wikicorpus J TO E Bleu EN21.55Score (%)96.9
Open Japanese LLM - Mbpp Pylint Check14.26Score (%)42.7
Open Japanese LLM - CG1.41Score (%)36.8
EuroEval Spanish NLU - ScaLA ES1.58Linguistic acceptability Score (%)30.4
SALAD-Bench Attack7.78Safety Score (%)30.3
EuroEval Faroese NLU - ScaLA FO0.45Linguistic acceptability Score (%)24.7
Open LLM Leaderboard - MuSR4.3Score21.2
SALAD-Bench44.07Average Safety Score (%)21.2
SALAD-Bench Base80.36Safety Score (%)21.2
EuroEval Portuguese NLU - ScaLA PT1Linguistic acceptability Score (%)19
EuroEval Norwegian Common Sense Reasoning1.59Common Sense Reasoning Average Score (%)18
Open Japanese LLM - Xlsum JA Rouge117.52Score (%)18

Interactive version: theaggregate.ai/model?slug=qwen-1-5-0-5b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.