Qwen 3 Max (2025-09-23): benchmark results

September 23, 2025 Qwen 3 Max snapshot, tracked when sources report the dated API model. Provider: Alibaba. Released 2025-09-23. Access: API.

Unified ELO 1637 ± 1, rank #156 of 1392 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MATH Level 597.13Accuracy (%)93.5
Wolfram LLM Benchmarking Project57.2Correct Functionality (%)84.6
Chatbot Arena (Text - Multi-Turn)1449Arena Score80.1
Chatbot Arena (Text - Russian)1431Arena Score75.5
Chatbot Arena (Text - Hard Prompts)1447Arena Score74.4
Chatbot Arena (Text - German)1437Arena Score73.9
Chatbot Arena (Text - Creative Writing)1394Arena Score73.7
Chatbot Arena (Text - Coding)1474Arena Score73.6
Chatbot Arena (Text - Math)1425Arena Score73.3
Chatbot Arena (Text)1424Elo72.4
Chatbot Arena (Text - Instruction Following)1414Arena Score71.8
Chatbot Arena (Text - Korean)1387Arena Score71.8

Interactive version: theaggregate.ai/model?slug=qwen-3-max-2025-09-23 · How It Works · Data refreshed daily, snapshot 2026-09-05.