Qwen 3 Max (2026-01-23) — benchmark results

January 23, 2026 Qwen 3 Max snapshot, tracked when sources report the dated API model. Provider: Alibaba. Released 2026-01-23. Access: API.

Unified ELO 1727 ± 24, rank #226 of 1776 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenCompass Language - Dialogue98.9Score (%)100
OpenCompass Code - Competition66.1Score (%)96
Vals AI CorpFin v268.03Accuracy (%)93.4
Vals AI GPQA84.85Accuracy (%)69.7
Vals AI MMLU-Pro84.98Accuracy (%)62.8
OpenCompass Agent - Multi-Turn75.2Score (%)62
Vals AI IOI13.75Accuracy (%)51.7
Vals AI CaseLaw v254.98Accuracy (%)35.1
NYT Connections Extended42.5Score (%)33.7
OpenClawProBench59.8Overall Score (%)31.8
Vals AI MedScribe72.71Accuracy (%)22.2
Vals AI Terminal-Bench 2.020.23Accuracy (%)13.6

Interactive version: theaggregate.ai/model?slug=qwen-3-max-2026-01-23 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.