Qwen-7B Chat — benchmark results
Provider: Alibaba. Released 2023-08-01. Access: Open.
Unified ELO 1236 ± 33, rank #1650 of 1776 rated models, from 20 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OpenEval - BBQ | 59.16 | Exact Match (%) | 53.4 |
| SALAD-Bench Base | 91.69 | Safety Score (%) | 48.5 |
| InfiBench | 37.36 | Score (%) | 46.7 |
| LogicKor - Understanding | 7.14 | Score (0-10) | 45.6 |
| LogicKor - Writing | 6.78 | Score (0-10) | 41.4 |
| OpenEval - Omni-MATH | 1.97 | Accuracy (%) | 32.5 |
| LogicKor - Math | 3.07 | Score (0-10) | 30.8 |
| SALAD-Bench | 49.44 | Average Safety Score (%) | 30.3 |
| OpenEval - IFEval Strict | 29.91 | Strict Accuracy (%) | 28.6 |
| LogicKor - Single-Turn | 5.4 | Score (0-10) | 28.5 |
| SALAD-Bench Attack | 7.18 | Safety Score (%) | 27.3 |
| LogicKor | 4.79 | Score (0-10) | 26.5 |
Interactive version: theaggregate.ai/model?slug=qwen-7b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.