Qwen 2 0.5B: benchmark results
Provider: Alibaba. Released 2024-06-06. Access: Open.
Unified ELO 1307 ± 1, rank #1339 of 1392 rated models, from 91 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Japanese LLM - Mbpp Pylint Check | 30.72 | Score (%) | 50.4 |
| Open Japanese LLM - CG | 6.02 | Score (%) | 46.5 |
| MERA - ruHumanEval | 3.6 | pass@1 (%) | 32 |
| MERA - ruCodeEval | 0.55 | pass@1 (%) | 26.3 |
| MERA - ruDetox | 9.13 | Joint Score (%) | 24.5 |
| Open Japanese LLM - Xlsum JA Rouge1 | 19.08 | Score (%) | 23.3 |
| Open LLM Leaderboard - MuSR | 4.6 | Score | 22.6 |
| MERA - LCS | 9.6 | Accuracy (%) | 22.5 |
| Open Japanese LLM - Jemhopqa Char F1 | 41.22 | Score (%) | 21.6 |
| MERA - ruHateSpeech | 56.6 | Accuracy (%) | 21.4 |
| Open Japanese LLM - Xlsum JA RougeLsum | 15.77 | Score (%) | 20.9 |
| Open Japanese LLM - Jsem Exact Match | 67.3 | Score (%) | 19.5 |
Interactive version: theaggregate.ai/model?slug=qwen-2-0-5b · How It Works · Data refreshed daily, snapshot 2026-09-05.