Qwen 1.5 7B Chat — benchmark results
Provider: Alibaba. Released 2024-02-05. Access: Open.
Unified ELO 1316 ± 17, rank #1500 of 1776 rated models, from 110 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| RewardBench Reasoning | 90.41 | Accuracy (%) | 74 |
| OpenEval - BBQ | 76.58 | Exact Match (%) | 72.4 |
| ChineseSafe Benchmark | 70.36 | Accuracy (%) | 70.4 |
| BiGGen-Bench | 3.56 | Average Score (1-5) | 63.7 |
| RewardBench Chat Hard | 69.08 | Accuracy (%) | 63.6 |
| OpenEval - Omni-MATH | 9.54 | Accuracy (%) | 62.5 |
| OpenEval - MMLU-Pro CoT | 23.47 | CoT Correctness (%) | 59.5 |
| Open LLM Leaderboard - GPQA | 7.05 | Score | 59.2 |
| OpenEval - GPQA CoT | 24.44 | CoT Correctness (%) | 57.1 |
| OpenEval - IFEval Strict | 41.53 | Strict Accuracy (%) | 54.8 |
| SALAD-Bench Base | 93 | Safety Score (%) | 51.5 |
| RewardBench | 67.5 | Score (%) | 47.5 |
Interactive version: theaggregate.ai/model?slug=qwen-1-5-7b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.