Qwen 3 4B (Non-reasoning): benchmark results
Provider: Alibaba. Released 2025-04-29. Access: Open.
Unified ELO 1437 ± 1, rank #1325 of 1935 rated models, from 294 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Ukrainian Summarization - LR SUM UK | 31.56 | Score (%) | 97.2 |
| EuroEval Albanian Summarization - LR SUM SQ | 34.22 | Score (%) | 95.4 |
| EuroEval Catalan Summarization - Dacsa CA | 38.84 | Score (%) | 92.9 |
| EuroEval Serbian Summarization - LR SUM SR | 30.35 | Score (%) | 91.2 |
| EuroEval Bosnian Summarization - LR SUM BS | 30.91 | Score (%) | 89.5 |
| EuroEval Icelandic Summarization - RRN | 37.83 | Score (%) | 88.3 |
| EuroEval Ukrainian NLU - Cross Domain UK Reviews | 61.43 | Sentiment classification Score (%) | 88 |
| EuroEval Italian Summarization - Ilpost SUM | 38.3 | Score (%) | 87 |
| EuroEval English Summarization - CNN Dailymail | 43.2 | Score (%) | 86.7 |
| EuroEval Portuguese Summarization - Publico | 33.3 | Score (%) | 86.6 |
| EuroEval Albanian NLU - MultiWikiQA SQ | 60.62 | Reading comprehension Score (%) | 84.4 |
| EuroEval Catalan NLU | 58.03 | NLU Average Score (%) | 84.4 |
Interactive version: theaggregate.ai/model?slug=qwen-3-4b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-25.