EuroEval Czech NLU - SQAD — leaderboard
Metric: Reading comprehension Score (%). Source: euroeval.com. 228 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Ministral-3-14B-Reasoning-2512 | 72.74 |
| 2 | GPT-5 | 72.33 |
| 3 | Ministral 3 14B | 72.06 |
| 4 | Ministral 3 8B | 71.99 |
| 5 | Ministral 3 3B | 70.84 |
| 6 | GPT-5.4 Mini (High) | 70.77 |
| 7 | GPT-5.4 Mini (Medium) | 70.68 |
| 8 | GPT-5 Mini | 70.67 |
| 9 | GPT-5 Nano | 70.09 |
| 10 | GPT-5.4 Mini (Non-reasoning) | 69.99 |
| 11 | SOLAR-10.7B-v1.0 | 69.78 |
| 12 | Ministral-3-14B-Instruct-2512 | 69.7 |
| 13 | gemma-3-12B-pt | 69.39 |
| 14 | Claude Sonnet 4.5 (Non-reasoning) | 69.2 |
| 15 | gemma-3-27B-pt | 68.88 |
Interactive version: theaggregate.ai/benchmark?slug=euroeval-czech-nlu-sqad · How the rankings work · Data refreshed daily, snapshot 2026-07-22.