Qwen 3 8B — benchmark results
Alibaba's open 8B dense Qwen3 (April 2025) with switchable thinking/non-thinking modes and 119-language coverage. Provider: Alibaba. Released 2025-04-28. Access: Open.
Unified ELO 1428 ± 10, rank #1090 of 1776 rated models, from 581 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Benchmarking Large Language Models for Graphem | 100.15 | Direct (self-reported) | 100 |
| Finetuning with Scientific Data Increases Hall | 67.1 | OFS (self-reported) | 100 |
| MuPPET | 70.37 | Multi-Party (self-reported) | 100 |
| Ukrainian LLM - Flores CS UK | 29.73 | Score (%) | 100 |
| Ukrainian LLM - Flores DE UK | 38.83 | Score (%) | 100 |
| Ukrainian LLM - Flores EN UK | 70.67 | Score (%) | 100 |
| Ukrainian LLM - Flores HU UK | 26.38 | Score (%) | 100 |
| Ukrainian LLM - Flores PL UK | 44.89 | Score (%) | 100 |
| Ukrainian LLM - Flores RO UK | 41.19 | Score (%) | 100 |
| Ukrainian LLM - Flores RU UK | 66.17 | Score (%) | 100 |
| Ukrainian LLM - Flores SK UK | 36.12 | Score (%) | 100 |
| Ukrainian LLM - Flores UK | 57.53 | Score (%) | 100 |
Interactive version: theaggregate.ai/model?slug=qwen-3-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.