Qwen3-14B-Base: benchmark results

Provider: Alibaba. Access: Open.

Unified ELO 1558 ± 25, rank #805 of 2656 rated models, from 155 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Swallow - Pre-trained Japanese - JHumanEval70.9Pass@1 (%)100
Swallow - Pre-trained English - HumanEval70.9Pass@1 (%)99
Swallow - Pre-trained Japanese - XL-Sum26.1ROUGE-2 (%)95.9
Swallow - Pre-trained English - Average69.2Average Score (%)93.9
Swallow - Pre-trained English - MMLU80.6Accuracy (%)93.9
Swallow - Pre-trained English - SQuAD266.9Exact Match (%)93.9
Swallow - Pre-trained Japanese - MGSM76.8Exact Match (%)93.9
Swallow - Pre-trained English - OpenBookQA41.6Accuracy (%)92.9
Swallow - Pre-trained Japanese - Average59.1Average Score (%)92.9
Swallow - Pre-trained English - MATH54.8Exact Match (%)91.8
Swallow - Pre-trained English - BBH78.7Exact Match (%)89.8
Swallow - Pre-trained Japanese - JMMLU72.9Accuracy (%)89.8

Interactive version: theaggregate.ai/model?slug=qwen3-14b-base · How It Works · Data refreshed daily, snapshot 2026-09-19.