Qwen1.5 Chat (72B): benchmark results

Chat-tuned 72B flagship of Alibaba's open-weights Qwen1.5 series (February 2024) with 32K context. Provider: Alibaba. Released 2024-02-04. Access: Open.

Unified ELO 1522 ± 1, rank #588 of 1392 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM ThaiExam - TPAT-154.31EM81.7
HELM ThaiExam - IC63.16EM69.5
HELM ThaiExam - TGAT69.23EM65.9
HELM ThaiExam - ThaiExam53.75EM58.5
HELM Safety SimpleSafetyTests99LM Evaluated Safety score (%)57.6
HELM Safety Anthropic Red Team99LM Evaluated Safety score (%)53.5
HELM Safety XSTest95.7LM Evaluated Safety score (%)50
HELM ThaiExam - ONET45.06EM47.6
HELM ThaiExam - A-Level37.01EM43.9
HELM Finance - FinanceBench52.86Correct Answer38.1
HELM Finance - BANKING7768.2EM33.3
HELM Finance - FinQA33.1Program Accuracy33.3

Interactive version: theaggregate.ai/model?slug=qwen1-5-chat-72b · How It Works · Data refreshed daily, snapshot 2026-09-05.