TinySwallow-1.5B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1410 ± 43, rank #1824 of 2656 rated models, from 26 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Swallow - Pre-trained Japanese - XL-Sum17.3ROUGE-2 (%)56.1
Swallow - Pre-trained Japanese - JCommonsenseQA84Accuracy (%)46.9
Swallow - Pre-trained Japanese - Average40.2Average Score (%)40.8
Swallow - Pre-trained Japanese - JMMLU44.6Accuracy (%)40.8
Swallow - Pre-trained Japanese - NIILC47.4Character F1 (%)40.8
Swallow - Pre-trained Japanese - MGSM25.6Exact Match (%)38.8
Swallow - Pre-trained English - GSM8K37.9Exact Match (%)36.7
Swallow - Pre-trained English - MMLU54.6Accuracy (%)34.7
Swallow - Pre-trained Japanese - JHumanEval23.1Pass@1 (%)34.7
Swallow - Pre-trained English - MATH16.2Exact Match (%)30.6
Swallow - Pre-trained English - Average41.8Average Score (%)28.6
pfgen-bench - Completion Mode - Helpfulness0.05Helpfulness Score27.8

Interactive version: theaggregate.ai/model?slug=tinyswallow-1-5b · How It Works · Data refreshed daily, snapshot 2026-09-19.