Qwen 1.5 0.5B Chat — benchmark results

Provider: Alibaba. Released 2024-02-04. Access: Open.

Unified ELO 1086 ± 27, rank #1765 of 1776 rated models, from 138 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Wikicorpus J TO E Bleu EN65.32Score (%)99.5
Open Japanese LLM - ALT E TO J Bleu JA32.43Score (%)96.6
Open Japanese LLM - Wikicorpus E TO J Bleu JA40.18Score (%)96.2
RewardBench Chat Hard62.94Accuracy (%)54.5
OpenEval - MMLU-Pro CoT5.62CoT Correctness (%)31
Open LLM Leaderboard - MuSR6.06Score29.1
EuroEval Spanish NLU - MLQA ES44.87Reading comprehension Score (%)28.9
EuroEval French NLU - FQuAD44.28Reading comprehension Score (%)27.1
EuroEval Icelandic Knowledge2.15Knowledge Average Score (%)26.3
EuroEval Portuguese NLU - MultiWikiQA PT41.92Reading comprehension Score (%)26.3
EuroEval Italian NLU - SQuAD IT40.64Reading comprehension Score (%)25.1
Open LLM Leaderboard - GPQA2.57Score23.9

Interactive version: theaggregate.ai/model?slug=qwen-1-5-0-5b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.