Qwen 1.5 32B Chat: benchmark results

Alibaba's dense 32B chat model in the Qwen1.5 line (32K context, April 2024), released under the custom commercial-use Qwen license. Provider: Alibaba. Released 2024-04-02. Access: Open.

Unified ELO 1486 ± 1, rank #751 of 1392 rated models, from 120 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic90.78Accuracy (%)97
Open Chinese LLM - HellaSwag70.43Accuracy (%)94.7
Open Chinese LLM - ARC Challenge60.67Accuracy (%)89.3
Open Chinese LLM - TruthfulQA MC60.87Accuracy (%)85.2
Open LLM Leaderboard - BBH44.55Score84.9
Open Japanese LLM - Xlsum JA Bert Score JA F170.34Score (%)84.5
BiGGen-Bench3.81Average Score (1-5)83.3
Open LLM Leaderboard - MMLU-Pro38.41Score82.7
Open Chinese LLM - WinoGrande67.4Accuracy (%)82.5
Open Japanese LLM - Xlsum JA RougeLsum25.5Score (%)82.5
Open Japanese LLM - Xlsum JA Rouge130.12Score (%)82.3
Open Chinese LLM - CMMLU68Accuracy (%)78.6

Interactive version: theaggregate.ai/model?slug=qwen-1-5-32b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.