Qwen 3 14B (Non-reasoning): benchmark results

Qwen 3 14B evaluated with reasoning disabled. Provider: Alibaba. Released 2025-04-28. Access: Open.

Unified ELO 1495 ± 1, rank #952 of 1919 rated models, from 288 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
When Simulation Lies52.92Pert Acc (self-reported)100
EuroEval Dutch Summarization - Wiki Lingua NL36.05Score (%)98.7
EuroEval Latvian NLU - MultiWikiQA LV72.18Reading comprehension Score (%)98.7
EuroEval Danish NLU - Multi Wiki QA DA82.01Reading comprehension Score (%)97.8
EuroEval Albanian NLU - MultiWikiQA SQ68.4Reading comprehension Score (%)97.5
EuroEval Portuguese NLU - MultiWikiQA PT78.55Reading comprehension Score (%)97.2
EuroEval Slovene NLU - MultiWikiQA SL72.27Reading comprehension Score (%)96.6
EuroEval Icelandic Summarization - RRN38.85Score (%)96.1
EuroEval Catalan NLU - MultiWikiQA CA76.65Reading comprehension Score (%)95.7
EuroEval French NLU - FQuAD75.59Reading comprehension Score (%)95.7
EuroEval Dutch Simplification - Duidelijke Taal56.34Score (%)95.5
EuroEval Hungarian NLU - HuSST62.4Sentiment classification Score (%)95.5

Interactive version: theaggregate.ai/model?slug=qwen-3-14b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-08.