Qwen 3 0.6B: benchmark results
Alibaba's open Qwen 3 0.6B, the smallest Qwen 3 model, with hybrid thinking (April 2025). Provider: Alibaba. Released 2025-04-28. Access: Open.
Unified ELO 1371 ± 1, rank #1216 of 1392 rated models, from 384 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MERA - ruMultiAr | 63.96 | EM (%) | 83.7 |
| AI Energy Score (Reasoning) | 5 | Energy Score (1-5) | 82.4 |
| MERA - MathLogicQA | 81.71 | Accuracy (%) | 81.3 |
| EuroEval Catalan Summarization - Dacsa CA | 36.68 | Score (%) | 81.2 |
| AI Energy Score (Text Generation) | 5 | Energy Score (1-5) | 79.5 |
| MERA Code - CodeCorrectness | 79.5 | Accuracy (%) | 72.3 |
| Open Arabic LLM - Madinah QA Arabic Language (Grammar) | 35.62 | Accuracy (%) | 57.7 |
| Open Arabic LLM - Aratrust Offensive | 82.61 | Accuracy (%) | 57.5 |
| Open Arabic LLM - Arabic MMLU Arabic Language (Grammar) | 36.44 | Accuracy (%) | 57.1 |
| EuroEval Dutch Summarization - Wiki Lingua NL | 32.38 | Score (%) | 54 |
| MERA Code - ruHumanEval | 28.05 | pass@1 (%) | 53.8 |
| EuroEval Catalan NLU - ScaLA CA | 5.89 | Linguistic acceptability Score (%) | 51.7 |
Interactive version: theaggregate.ai/model?slug=qwen-3-0-6b · How It Works · Data refreshed daily, snapshot 2026-09-05.