Qwen3.5-2B-Base: benchmark results

Provider: Alibaba. Released 2026-03-02. Access: Open.

Unified ELO 1402 ± 1, rank #1507 of 1906 rated models, from 293 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Italian NLU - SQuAD IT74.47Reading comprehension Score (%)93.2
EuroEval English NLU - SQuAD86.3Reading comprehension Score (%)91.7
EuroEval German NLU - Germanquad65.71Reading comprehension Score (%)91.6
EuroEval French NLU - FQuAD73.93Reading comprehension Score (%)91.2
EuroEval Greek NLU - MultiWikiQA EL68.96Reading comprehension Score (%)89.7
EuroEval Finnish NLU - Tydiqa FI72.21Reading comprehension Score (%)89.3
EuroEval Dutch NLU - SQuAD NL78.88Reading comprehension Score (%)89.2
EuroEval Spanish NLU - MLQA ES66.89Reading comprehension Score (%)89.2
EuroEval Icelandic NLU - NQII56.65Reading comprehension Score (%)89
EuroEval Serbian NLU - MultiWikiQA SR63.45Reading comprehension Score (%)88.2
EuroEval Albanian NLU - MultiWikiQA SQ60.91Reading comprehension Score (%)84.9
EuroEval Estonian NLU - MultiWikiQA ET68.59Reading comprehension Score (%)83.9

Interactive version: theaggregate.ai/model?slug=qwen3-5-2b-base · How It Works · Data refreshed daily, snapshot 2026-09-24.