Qwen 1.5 7B Chat — benchmark results

Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1316 ± 17, rank #1500 of 1776 rated models, from 110 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
RewardBench Reasoning90.41Accuracy (%)74
OpenEval - BBQ76.58Exact Match (%)72.4
ChineseSafe Benchmark70.36Accuracy (%)70.4
BiGGen-Bench3.56Average Score (1-5)63.7
RewardBench Chat Hard69.08Accuracy (%)63.6
OpenEval - Omni-MATH9.54Accuracy (%)62.5
OpenEval - MMLU-Pro CoT23.47CoT Correctness (%)59.5
Open LLM Leaderboard - GPQA7.05Score59.2
OpenEval - GPQA CoT24.44CoT Correctness (%)57.1
OpenEval - IFEval Strict41.53Strict Accuracy (%)54.8
SALAD-Bench Base93Safety Score (%)51.5
RewardBench67.5Score (%)47.5

Interactive version: theaggregate.ai/model?slug=qwen-1-5-7b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.