Qwen Max: benchmark results
Alibaba's flagship Qwen Max model, represented here as a 700B-parameter closed model. Provider: Alibaba. Released 2025-04-28. Access: API.
Unified ELO 1564 ± 1, rank #388 of 1392 rated models, from 25 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| ACEBench | 81.7 | Overall (self-reported) | 89.3 |
| Enkrypt AI - Safety Risk | 20.27 | Risk Score | 83.2 |
| DuckDB-NSQL | 64 | Execution Accuracy (%) | 77.6 |
| AsyncTool | 25.56 | Overall (self-reported) | 72.2 |
| Enkrypt AI - Toxicity Risk | 1.91 | Risk Score | 70.2 |
| Enkrypt AI - Jailbreak Risk | 6.25 | Risk Score | 69.1 |
| Enkrypt AI - Insecure Code Risk | 19.56 | Risk Score | 66.9 |
| Enkrypt AI - Risk Score | 29.13 | Risk Score | 62.5 |
| SpeechMap Compliance | 66.8 | % Requests Completed | 57.3 |
| SuiChat-CN | 68.6 | Standard F1 (self-reported) | 55.8 |
| FullStackBench en | 55.16 | Score (self-reported) | 53.3 |
| Enkrypt AI - Bias Risk | 83.72 | Risk Score | 51.5 |
Interactive version: theaggregate.ai/model?slug=qwen-max · How It Works · Data refreshed daily, snapshot 2026-09-05.