Qwen-7B Chat: benchmark results
Provider: Alibaba. Released 2023-08-01. Access: Open.
Unified ELO 1361 ± 1, rank #1245 of 1392 rated models, from 21 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SALAD-Bench Base | 91.69 | Safety Score (%) | 48.5 |
| InfiBench | 37.36 | Score (%) | 46.7 |
| LogicKor - Understanding | 7.14 | Score (0-10) | 43.3 |
| LogicKor - Writing | 6.78 | Score (0-10) | 39.3 |
| OpenEval - BBQ | 59.16 | Exact Match (%) | 36.4 |
| SALAD-Bench | 49.44 | Average Safety Score (%) | 30.3 |
| LogicKor - Math | 3.07 | Score (0-10) | 29.2 |
| SALAD-Bench Attack | 7.18 | Safety Score (%) | 27.3 |
| LogicKor - Single-Turn | 5.4 | Score (0-10) | 27.1 |
| LogicKor | 4.79 | Score (0-10) | 25.2 |
| MathBench | 27.7 | Average Score | 24.2 |
| LogicKor - Multi-Turn | 4.19 | Score (0-10) | 22.1 |
Interactive version: theaggregate.ai/model?slug=qwen-7b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.