Swallow - Pre-trained English - MMLU: leaderboard

Metric: Accuracy (%). Source: swallow-llm.github.io. 50 models tracked.

Top models

#ModelScore
1Qwen 2.5 72B86.1
2Qwen 2.5 32B83.2
3Qwen3-30B-A3B-Base81.2
4Qwen3-14B-Base80.6
5Qwen 2.5 14B79.7
6Llama 3.1 70B78.6
7Llama 4 Scout Base78
8gemma-3-27B-pt78
9Qwen3-8B-Base76.5
10Gemma 2 27B75.4
11Qwen 2.5 7B74.2
12gemma-3-12B-pt73.7
13Falcon3-10B-Base73.2
14Qwen3-4B-Base72.9
15Gemma 2 9B70.6

Interactive version: theaggregate.ai/benchmark?slug=swallow-pre-trained-english-mmlu · How It Works · Data refreshed daily, snapshot 2026-09-19.