Qwen1.5 Chat (72B) — benchmark results

Chat-tuned 72B flagship of Alibaba's open-weights Qwen1.5 series (February 2024) with 32K context. Provider: Alibaba. Released 2024-02-04. Access: Open.

Unified ELO 1482 ± 20, rank #869 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM ThaiExam - TPAT-154.31EM81.7
HELM ThaiExam - IC63.16EM69.5
HELM ThaiExam - TGAT69.23EM65.9
HELM ThaiExam - ThaiExam53.75EM58.5
HELM Safety SimpleSafetyTests99LM Evaluated Safety score (%)57.6
HELM Safety Anthropic Red Team99LM Evaluated Safety score (%)53.5
HELM Safety XSTest95.7LM Evaluated Safety score (%)50
HELM ThaiExam - ONET45.06EM47.6
HELM ThaiExam - A-Level37.01EM43.9
HELM Finance - FinanceBench52.86Correct Answer38.1
HELM Safety88.62Mean score (self-reported)34.7
HELM Finance - BANKING7768.2EM33.3

Interactive version: theaggregate.ai/model?slug=qwen1-5-chat-72b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.