Qwen3.5-4B-Base: benchmark results

Provider: Alibaba. Released 2026-03-01. Access: Open.

Unified ELO 1485 ± 1, rank #1014 of 1906 rated models, from 293 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Faroese NLU - FoQA82.59Reading comprehension Score (%)100
EuroEval Finnish NLU - Tydiqa FI77.51Reading comprehension Score (%)99.5
EuroEval Icelandic NLU - NQII65.37Reading comprehension Score (%)99.5
EuroEval Italian NLU - SQuAD IT78.05Reading comprehension Score (%)99.3
EuroEval Czech NLU - SQAD72.57Reading comprehension Score (%)98.7
EuroEval Bosnian NLU - Multi Wiki QA BS76.27Reading comprehension Score (%)98.6
EuroEval Bulgarian NLU - Cinexio61.35Sentiment classification Score (%)98.6
EuroEval Dutch NLU - SQuAD NL84.17Reading comprehension Score (%)98.5
EuroEval Polish NLU - PoQuAD65.76Reading comprehension Score (%)98.3
EuroEval Estonian NLU - MultiWikiQA ET75.36Reading comprehension Score (%)98
EuroEval German NLU - Germanquad68.99Reading comprehension Score (%)97.8
EuroEval Swedish NLU - Multi Wiki QA SV80.75Reading comprehension Score (%)97.2

Interactive version: theaggregate.ai/model?slug=qwen3-5-4b-base · How It Works · Data refreshed daily, snapshot 2026-09-24.