Qwen 3 30B A3B 2507 (Thinking): benchmark results

Qwen 3 30B A3B 2507 thinking snapshot. Provider: Alibaba. Released 2025-07-01. Access: Open.

Unified ELO 1528 ± 1, rank #724 of 1761 rated models, from 185 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MERA - MathLogicQA99.74Accuracy (%)98.6
MERA - ruMultiAr100EM (%)98.6
MERA Code - ruHumanEval79.88pass@1 (%)98.5
MERA Code - ruCodeEval74.15pass@1 (%)96.9
MERA - ruHateSpeech92.08Accuracy (%)96.4
HealthBench Hard58Overall score (self-reported)95.7
MERA - SimpleAr100EM (%)95.7
MERA - ruModAr99.77EM (%)94.3
MERA - ruTiE90.87Accuracy (%)93.8
MERA - LCS55.6Accuracy (%)93.3
MERA - RCB60.05Accuracy (%)92.8
BRIDGE Medical Leaderboard - CoT41.43Average Performance (%)92.6

Interactive version: theaggregate.ai/model?slug=qwen-3-30b-a3b-2507-thinking · How It Works · Data refreshed daily, snapshot 2026-09-05.