Qwen 3.8 Max (xHigh): benchmark results

Provider: Alibaba. Released 2026-08-03. Access: API.

Unified ELO 1702 ± 1, rank #99 of 1761 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OTIS Mock AIME 2024-2599.44Accuracy (%)96.9
Epoch AI - Mystery Game Puzzles38Score93.5
FrontierMath - Tiers 1-3 (v2)74.74Accuracy (%, 285 private v2 problems)90.6
Conceptual Reasoning Index - Argument Evaluation (LMCA)46.24Chance-Corrected Score (0-100)87.8
Epoch AI - Dtbench92Score86.9
LLM2014 Logic 2026-0860.05Median Score86.4
SuperCLUE-Terminal - Overall49.49Score80
Chess Puzzles (Epoch AI)29Accuracy (%)78.5
LLM2014 Logic 2026-0955.61Median Score75
FrontierMath - Tier 4 (v2)46.34Accuracy (%, 41 private v2 problems)70.6
SimpleQA Verified45.8Accuracy (%)62.3
DeepsecBench16.47Recall-weighted F2 score (%)60

Interactive version: theaggregate.ai/model?slug=qwen-3-8-max-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.