Qwen 3 14B (Non-reasoning) — benchmark results

Qwen 3 14B evaluated with reasoning disabled. Provider: Alibaba. Released 2025-04-28. Access: Open.

Unified ELO 1568 ± 7, rank #570 of 1776 rated models, from 299 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Dutch Summarization - Wiki Lingua NL36.05Score (%)98.7
EuroEval Latvian NLU - MultiWikiQA LV72.18Reading comprehension Score (%)98.7
EuroEval Danish NLU - Multi Wiki QA DA82.01Reading comprehension Score (%)97.8
EuroEval Albanian NLU - MultiWikiQA SQ68.4Reading comprehension Score (%)97.5
EuroEval Portuguese NLU - MultiWikiQA PT78.55Reading comprehension Score (%)97.2
EuroEval Slovene NLU - MultiWikiQA SL72.27Reading comprehension Score (%)96.6
EuroEval Icelandic Summarization - RRN38.85Score (%)96.1
EuroEval Catalan NLU - MultiWikiQA CA76.65Reading comprehension Score (%)95.7
EuroEval French NLU - FQuAD75.59Reading comprehension Score (%)95.7
EuroEval Dutch Simplification - Duidelijke Taal56.34Score (%)95.5
EuroEval Hungarian NLU - HuSST62.4Sentiment classification Score (%)95.5
EuroEval Hungarian NLU - MultiWikiQA HU69.66Reading comprehension Score (%)95.5

Interactive version: theaggregate.ai/model?slug=qwen-3-14b-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.