Qwen 3.5 27B (Reasoning): benchmark results

Provider: Alibaba. Released 2026-02-24. Access: Open.

Unified ELO 1639 ± 1, rank #423 of 3363 rated models, from 189 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SEA-HELM (Burmese) - SEA-Safeguard89.24Normalized Score100
SEA-HELM (Tamil) - SEA-IFEval95.7Normalized Score100
SEA-HELM (Burmese) - SEA-IFEval85.71Normalized Score98.2
SEA-HELM (Indonesian) - Natural Language Inference83.23Normalized Score98.2
SEA-HELM (Tamil) - NLR75.31Normalized Score98.2
SEA-HELM (Thai) - NLU64.55Normalized Score97.4
SEA-HELM (English) - Knowledge75.65Normalized Score96.5
SEA-HELM (English) - SuperGPQA60.01Normalized Score96.5
SEA-HELM (Indonesian) - Global MMLU Lite85.23Normalized Score96.5
SEA-HELM (Indonesian) - SEA-MT-Bench (LLM Judge)87.29Normalized Score96.5
SEA-HELM (Tamil) - Causal Reasoning95.49Normalized Score96.5
SEA-HELM (Tamil) - Natural Language Inference55.14Normalized Score96.5

Interactive version: theaggregate.ai/model?slug=qwen-3-5-27b-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-23.