Qwen 1.5 1.8B: benchmark results

Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1301 ± 1, rank #1346 of 1392 rated models, from 226 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA7.38Score62.2
Open Japanese LLM - Mbpp Pylint Check12.85Score (%)41
Open Japanese LLM - CG1.41Score (%)36.8
MERA - ruHumanEval4.76pass@1 (%)36.1
MERA - ruCodeEval2.26pass@1 (%)34.7
MERA - LCS10.8Accuracy (%)32.1
Open Arabic LLM - Arabic MMLU HT Machine Learning31.25Accuracy (%)27.2
EuroEval Norwegian Knowledge4.43Knowledge Average Score (%)26.3
Open Arabic LLM - Arabic MMLU HT College Physics22.55Accuracy (%)24.1
Open Arabic LLM - Arabic MMLU Physics (High School)29.41Accuracy (%)23.8
EuroEval Portuguese NLU - MultiWikiQA PT30.19Reading comprehension Score (%)21
Open LLM Leaderboard - MMLU-Pro9.8Score20.5

Interactive version: theaggregate.ai/model?slug=qwen-1-5-1-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.