Qwen 3 30B A3B 2507 (Thinking): benchmark results
Qwen 3 30B A3B 2507 thinking snapshot. Provider: Alibaba. Released 2025-07-01. Access: Open.
Unified ELO 1528 ± 1, rank #724 of 1761 rated models, from 185 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MERA - MathLogicQA | 99.74 | Accuracy (%) | 98.6 |
| MERA - ruMultiAr | 100 | EM (%) | 98.6 |
| MERA Code - ruHumanEval | 79.88 | pass@1 (%) | 98.5 |
| MERA Code - ruCodeEval | 74.15 | pass@1 (%) | 96.9 |
| MERA - ruHateSpeech | 92.08 | Accuracy (%) | 96.4 |
| HealthBench Hard | 58 | Overall score (self-reported) | 95.7 |
| MERA - SimpleAr | 100 | EM (%) | 95.7 |
| MERA - ruModAr | 99.77 | EM (%) | 94.3 |
| MERA - ruTiE | 90.87 | Accuracy (%) | 93.8 |
| MERA - LCS | 55.6 | Accuracy (%) | 93.3 |
| MERA - RCB | 60.05 | Accuracy (%) | 92.8 |
| BRIDGE Medical Leaderboard - CoT | 41.43 | Average Performance (%) | 92.6 |
Interactive version: theaggregate.ai/model?slug=qwen-3-30b-a3b-2507-thinking · How It Works · Data refreshed daily, snapshot 2026-09-05.