Qwen 3 Max (2026-01-23) — benchmark results
January 23, 2026 Qwen 3 Max snapshot, tracked when sources report the dated API model. Provider: Alibaba. Released 2026-01-23. Access: API.
Unified ELO 1727 ± 24, rank #226 of 1776 rated models, from 13 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OpenCompass Language - Dialogue | 98.9 | Score (%) | 100 |
| OpenCompass Code - Competition | 66.1 | Score (%) | 96 |
| Vals AI CorpFin v2 | 68.03 | Accuracy (%) | 93.4 |
| Vals AI GPQA | 84.85 | Accuracy (%) | 69.7 |
| Vals AI MMLU-Pro | 84.98 | Accuracy (%) | 62.8 |
| OpenCompass Agent - Multi-Turn | 75.2 | Score (%) | 62 |
| Vals AI IOI | 13.75 | Accuracy (%) | 51.7 |
| Vals AI CaseLaw v2 | 54.98 | Accuracy (%) | 35.1 |
| NYT Connections Extended | 42.5 | Score (%) | 33.7 |
| OpenClawProBench | 59.8 | Overall Score (%) | 31.8 |
| Vals AI MedScribe | 72.71 | Accuracy (%) | 22.2 |
| Vals AI Terminal-Bench 2.0 | 20.23 | Accuracy (%) | 13.6 |
Interactive version: theaggregate.ai/model?slug=qwen-3-max-2026-01-23 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.