Qwen 1.5 32B Chat — benchmark results

Alibaba's dense 32B chat model in the Qwen1.5 line (32K context, April 2024), released under the custom commercial-use Qwen license. Provider: Alibaba. Released 2024-04-02. Access: Open.

Unified ELO 1421 ± 23, rank #1124 of 1776 rated models, from 81 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic90.78Accuracy (%)97
Open Chinese LLM - HellaSwag70.43Accuracy (%)94.7
Open Chinese LLM - ARC Challenge60.67Accuracy (%)89.3
OpenEval - BBQ90.69Exact Match (%)86.2
Open Chinese LLM - TruthfulQA MC60.87Accuracy (%)85.2
Open LLM Leaderboard - BBH44.55Score84.9
Open Japanese LLM - Xlsum JA Bert Score JA F170.34Score (%)84.5
BiGGen-Bench3.81Average Score (1-5)83.3
Open LLM Leaderboard - MMLU-Pro38.41Score82.7
Open Chinese LLM - WinoGrande67.4Accuracy (%)82.5
Open Japanese LLM - Xlsum JA Rouge130.12Score (%)82.1
Open Japanese LLM - Xlsum JA RougeLsum25.5Score (%)82

Interactive version: theaggregate.ai/model?slug=qwen-1-5-32b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.