Qwen 1.5 1.8B: benchmark results
Provider: Alibaba. Released 2024-02-05. Access: Open.
Unified ELO 1301 ± 1, rank #1346 of 1392 rated models, from 226 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - GPQA | 7.38 | Score | 62.2 |
| Open Japanese LLM - Mbpp Pylint Check | 12.85 | Score (%) | 41 |
| Open Japanese LLM - CG | 1.41 | Score (%) | 36.8 |
| MERA - ruHumanEval | 4.76 | pass@1 (%) | 36.1 |
| MERA - ruCodeEval | 2.26 | pass@1 (%) | 34.7 |
| MERA - LCS | 10.8 | Accuracy (%) | 32.1 |
| Open Arabic LLM - Arabic MMLU HT Machine Learning | 31.25 | Accuracy (%) | 27.2 |
| EuroEval Norwegian Knowledge | 4.43 | Knowledge Average Score (%) | 26.3 |
| Open Arabic LLM - Arabic MMLU HT College Physics | 22.55 | Accuracy (%) | 24.1 |
| Open Arabic LLM - Arabic MMLU Physics (High School) | 29.41 | Accuracy (%) | 23.8 |
| EuroEval Portuguese NLU - MultiWikiQA PT | 30.19 | Reading comprehension Score (%) | 21 |
| Open LLM Leaderboard - MMLU-Pro | 9.8 | Score | 20.5 |
Interactive version: theaggregate.ai/model?slug=qwen-1-5-1-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.