Qwen Max: benchmark results

Alibaba's flagship Qwen Max model, represented here as a 700B-parameter closed model. Provider: Alibaba. Released 2025-04-28. Access: API.

Unified ELO 1564 ± 1, rank #388 of 1392 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ACEBench81.7Overall (self-reported)89.3
Enkrypt AI - Safety Risk20.27Risk Score83.2
DuckDB-NSQL64Execution Accuracy (%)77.6
AsyncTool25.56Overall (self-reported)72.2
Enkrypt AI - Toxicity Risk1.91Risk Score70.2
Enkrypt AI - Jailbreak Risk6.25Risk Score69.1
Enkrypt AI - Insecure Code Risk19.56Risk Score66.9
Enkrypt AI - Risk Score29.13Risk Score62.5
SpeechMap Compliance66.8% Requests Completed57.3
SuiChat-CN68.6Standard F1 (self-reported)55.8
FullStackBench en55.16Score (self-reported)53.3
Enkrypt AI - Bias Risk83.72Risk Score51.5

Interactive version: theaggregate.ai/model?slug=qwen-max · How It Works · Data refreshed daily, snapshot 2026-09-05.