Qwen 1.5 14B — benchmark results

Alibaba's 14B Qwen1.5 base model (February 2024) with 32K context, released under the Tongyi Qianwen license rather than Apache 2.0. Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1444 ± 10, rank #1027 of 1776 rated models, from 282 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM NaturalQuestions (Open)77.21F1 (%)85.6
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment NO Neutral Task80.28Accuracy (%)84
Open Chinese LLM - WinoGrande66.38Accuracy (%)77.9
Open Japanese LLM - Mbpp Pylint Check90.76Score (%)77.9
Open Chinese LLM - C-Eval Semantic85.04Accuracy (%)76.9
Open Chinese LLM - GSM8K55.8Accuracy (%)76.9
Open Korean LLM Leaderboard386.7Average Score (%)75.4
EuroEval Swedish NLU - Swerec77.2Sentiment classification Score (%)73.4
Open Chinese LLM Leaderboard61.65Average Score (%)73.3
Open Japanese LLM - Wiki NER SET F18.85Score (%)72
Open LLM Leaderboard - MATH Level 520.24Score71.3
Open Chinese LLM - CMMLU61.12Accuracy (%)70.3

Interactive version: theaggregate.ai/model?slug=qwen-1-5-14b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.