Qwen 3 4B (Non-reasoning): benchmark results

Provider: Alibaba. Released 2025-04-29. Access: Open.

Unified ELO 1437 ± 1, rank #1325 of 1935 rated models, from 294 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Ukrainian Summarization - LR SUM UK31.56Score (%)97.2
EuroEval Albanian Summarization - LR SUM SQ34.22Score (%)95.4
EuroEval Catalan Summarization - Dacsa CA38.84Score (%)92.9
EuroEval Serbian Summarization - LR SUM SR30.35Score (%)91.2
EuroEval Bosnian Summarization - LR SUM BS30.91Score (%)89.5
EuroEval Icelandic Summarization - RRN37.83Score (%)88.3
EuroEval Ukrainian NLU - Cross Domain UK Reviews61.43Sentiment classification Score (%)88
EuroEval Italian Summarization - Ilpost SUM38.3Score (%)87
EuroEval English Summarization - CNN Dailymail43.2Score (%)86.7
EuroEval Portuguese Summarization - Publico33.3Score (%)86.6
EuroEval Albanian NLU - MultiWikiQA SQ60.62Reading comprehension Score (%)84.4
EuroEval Catalan NLU58.03NLU Average Score (%)84.4

Interactive version: theaggregate.ai/model?slug=qwen-3-4b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-25.