Qwen 1.5 0.5B Chat: benchmark results

Provider: Alibaba. Released 2024-02-04. Access: Open.

Unified ELO 1281 ± 1, rank #1363 of 1392 rated models, from 144 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
RewardBench Chat Hard62.94Accuracy (%)54.5
MERA - LCS11.8Accuracy (%)42.1
Open LLM Leaderboard - MuSR6.06Score29.1
EuroEval Spanish NLU - MLQA ES44.87Reading comprehension Score (%)28.9
EuroEval French NLU - FQuAD44.28Reading comprehension Score (%)27.1
EuroEval Icelandic Knowledge2.15Knowledge Average Score (%)26.3
EuroEval Portuguese NLU - MultiWikiQA PT41.92Reading comprehension Score (%)26.3
EuroEval Italian NLU - SQuAD IT40.64Reading comprehension Score (%)25.1
Open LLM Leaderboard - GPQA2.57Score23.9
MERA - RWSD50.38Accuracy (%)21.8
EuroEval Faroese NLU - ScaLA FO0.26Linguistic acceptability Score (%)21.5
MERA - USE7.75Grade, normalized (%)18.7

Interactive version: theaggregate.ai/model?slug=qwen-1-5-0-5b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.