Qwen-7B Chat: benchmark results

Provider: Alibaba. Released 2023-08-01. Access: Open.

Unified ELO 1361 ± 1, rank #1245 of 1392 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SALAD-Bench Base91.69Safety Score (%)48.5
InfiBench37.36Score (%)46.7
LogicKor - Understanding7.14Score (0-10)43.3
LogicKor - Writing6.78Score (0-10)39.3
OpenEval - BBQ59.16Exact Match (%)36.4
SALAD-Bench49.44Average Safety Score (%)30.3
LogicKor - Math3.07Score (0-10)29.2
SALAD-Bench Attack7.18Safety Score (%)27.3
LogicKor - Single-Turn5.4Score (0-10)27.1
LogicKor4.79Score (0-10)25.2
MathBench27.7Average Score24.2
LogicKor - Multi-Turn4.19Score (0-10)22.1

Interactive version: theaggregate.ai/model?slug=qwen-7b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.