Qwen 1.5 110B Chat — benchmark results

Chat-tuned variant of Alibaba's 110B Qwen1.5 flagship (April 2024), roughly on par with Llama-3-70B-Instruct in chat evals. Provider: Alibaba. Released 2024-04-25. Access: Open.

Unified ELO 1483 ± 19, rank #865 of 1776 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MMLU-Pro42.5Score86.7
Open LLM Leaderboard - BBH44.98Score85.3
Open LLM Leaderboard - MuSR16.29Score85.3
Open LLM Leaderboard - GPQA12.19Score84.9
HREF40.76Average HREF Score (%)84.8
AlpacaEval 2.043.91LC Win Rate (%)83.3
MathBench58.4Average Score81.8
BenchBench74.2Aggregate Score (%)79.4
LiveBench Cta54Score77.1
Open LLM Leaderboard - MATH Level 523.41Score76.9
Open LLM Leaderboard - IFEval59.39Score71.2
LiveBench AMPS Hard23Score56.2

Interactive version: theaggregate.ai/model?slug=qwen-1-5-110b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.