Qwen-7B Chat — benchmark results

Provider: Alibaba. Released 2023-08-01. Access: Open.

Unified ELO 1236 ± 33, rank #1650 of 1776 rated models, from 20 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenEval - BBQ59.16Exact Match (%)53.4
SALAD-Bench Base91.69Safety Score (%)48.5
InfiBench37.36Score (%)46.7
LogicKor - Understanding7.14Score (0-10)45.6
LogicKor - Writing6.78Score (0-10)41.4
OpenEval - Omni-MATH1.97Accuracy (%)32.5
LogicKor - Math3.07Score (0-10)30.8
SALAD-Bench49.44Average Safety Score (%)30.3
OpenEval - IFEval Strict29.91Strict Accuracy (%)28.6
LogicKor - Single-Turn5.4Score (0-10)28.5
SALAD-Bench Attack7.18Safety Score (%)27.3
LogicKor4.79Score (0-10)26.5

Interactive version: theaggregate.ai/model?slug=qwen-7b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.