Qwen-14B-Chat — benchmark results
Alibaba's chat-aligned version of the original Qwen-14B (September 2023), pretrained on 3T multilingual tokens under the Tongyi Qianwen license. Provider: Alibaba. Released 2023-09-25. Access: Open.
Unified ELO 1411 ± 22, rank #1171 of 1776 rated models, from 37 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LLMsPark - Who Is Spy | 77 | Elo Rating | 100 |
| NPHardEval - EDP | 26.91 | Accuracy (%) | 81.8 |
| NPHardEval - GCP D | 56 | Accuracy (%) | 81.8 |
| NPHardEval - SAS | 70.55 | Accuracy (%) | 81.8 |
| OpenEval - BBQ | 82.48 | Exact Match (%) | 79.3 |
| InfiBench | 43.49 | Score (%) | 68.6 |
| LogicKor - Single-Turn | 7.02 | Score (0-10) | 66.8 |
| SALAD-Bench Base | 95.35 | Safety Score (%) | 66.7 |
| LogicKor - Reasoning | 6.42 | Score (0-10) | 65 |
| LogicKor - Grammar | 5.64 | Score (0-10) | 64.8 |
| LogicKor - Writing | 8.35 | Score (0-10) | 64.2 |
| GSM8K | 61.2 | Accuracy (%) | 63.8 |
Interactive version: theaggregate.ai/model?slug=qwen-14b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.