Qwen-14B-Chat: benchmark results
Alibaba's chat-aligned version of the original Qwen-14B (September 2023), pretrained on 3T multilingual tokens under the Tongyi Qianwen license. Provider: Alibaba. Released 2023-09-25. Access: Open.
Unified ELO 1438 ± 1, rank #999 of 1392 rated models, from 46 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LLMsPark - Who Is Spy | 77 | Elo Rating | 100 |
| NPHardEval - EDP | 26.91 | Accuracy (%) | 81.8 |
| NPHardEval - GCP D | 56 | Accuracy (%) | 81.8 |
| NPHardEval - SAS | 70.55 | Accuracy (%) | 81.8 |
| InfiBench | 43.49 | Score (%) | 68.6 |
| SALAD-Bench Base | 95.35 | Safety Score (%) | 66.7 |
| GSM8K | 61.2 | Accuracy (%) | 64.5 |
| NPHardEval | 22.28 | Average Accuracy (%) | 63.6 |
| NPHardEval - TSP | 1.27 | Accuracy (%) | 63.6 |
| LogicKor - Single-Turn | 7.02 | Score (0-10) | 63.4 |
| LogicKor - Reasoning | 6.42 | Score (0-10) | 62.6 |
| LogicKor - Writing | 8.35 | Score (0-10) | 62.6 |
Interactive version: theaggregate.ai/model?slug=qwen-14b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.