Qwen 1.5 7B Chat: benchmark results

Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1398 ± 1, rank #1139 of 1392 rated models, from 127 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
RewardBench Reasoning90.41Accuracy (%)74
ChineseSafe Benchmark70.36Accuracy (%)70.4
BiGGen-Bench3.56Average Score (1-5)63.7
RewardBench Chat Hard69.08Accuracy (%)63.6
MERA - RWSD58.46Accuracy (%)62.4
Open LLM Leaderboard - GPQA7.05Score59.2
OpenEval - BBQ76.58Exact Match (%)54.5
SALAD-Bench Base93Safety Score (%)51.5
RewardBench67.5Score (%)47.5
Open LLM Leaderboard - IFEval43.71Score46.6
MERA - SimpleAr97.3EM (%)45.7
MAGI-Hard41.59Accuracy (%, 2024-05 snapshot)44.8

Interactive version: theaggregate.ai/model?slug=qwen-1-5-7b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.