Qwen3-14B-Base: benchmark results
Provider: Alibaba. Access: Open.
Unified ELO 1558 ± 25, rank #805 of 2656 rated models, from 155 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Swallow - Pre-trained Japanese - JHumanEval | 70.9 | Pass@1 (%) | 100 |
| Swallow - Pre-trained English - HumanEval | 70.9 | Pass@1 (%) | 99 |
| Swallow - Pre-trained Japanese - XL-Sum | 26.1 | ROUGE-2 (%) | 95.9 |
| Swallow - Pre-trained English - Average | 69.2 | Average Score (%) | 93.9 |
| Swallow - Pre-trained English - MMLU | 80.6 | Accuracy (%) | 93.9 |
| Swallow - Pre-trained English - SQuAD2 | 66.9 | Exact Match (%) | 93.9 |
| Swallow - Pre-trained Japanese - MGSM | 76.8 | Exact Match (%) | 93.9 |
| Swallow - Pre-trained English - OpenBookQA | 41.6 | Accuracy (%) | 92.9 |
| Swallow - Pre-trained Japanese - Average | 59.1 | Average Score (%) | 92.9 |
| Swallow - Pre-trained English - MATH | 54.8 | Exact Match (%) | 91.8 |
| Swallow - Pre-trained English - BBH | 78.7 | Exact Match (%) | 89.8 |
| Swallow - Pre-trained Japanese - JMMLU | 72.9 | Accuracy (%) | 89.8 |
Interactive version: theaggregate.ai/model?slug=qwen3-14b-base · How It Works · Data refreshed daily, snapshot 2026-09-19.