Qwen3-0.6B-Base: benchmark results
Provider: Alibaba. Access: Open.
Unified ELO 1343 ± 43, rank #2271 of 2656 rated models, from 31 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Swallow - Pre-trained English - MATH | 33.4 | Exact Match (%) | 53.1 |
| Swallow - Pre-trained Japanese - MGSM | 30 | Exact Match (%) | 42.9 |
| Swallow - Pre-trained English - HumanEval | 29.5 | Pass@1 (%) | 41.8 |
| Swallow - Pre-trained English - GSM8K | 48.3 | Exact Match (%) | 40.8 |
| Swallow - Pre-trained English - BBH | 40.7 | Exact Match (%) | 34.7 |
| Swallow - Pre-trained Japanese - JCommonsenseQA | 70.5 | Accuracy (%) | 32.7 |
| Swallow - Pre-trained English - Average | 42 | Average Score (%) | 30.6 |
| Swallow - Pre-trained Japanese - JHumanEval | 21.6 | Pass@1 (%) | 30.6 |
| Swallow - Pre-trained English - MMLU | 52.3 | Accuracy (%) | 28.6 |
| Swallow - Pre-trained Japanese - JMMLU | 37.3 | Accuracy (%) | 24.5 |
| Swallow - Pre-trained Japanese - XL-Sum | 11.1 | ROUGE-2 (%) | 20.4 |
| pfgen-bench - Completion Mode - Fluency | 0.41 | Fluency Score | 18.5 |
Interactive version: theaggregate.ai/model?slug=qwen3-0-6b-base · How It Works · Data refreshed daily, snapshot 2026-09-19.