Qwen 3 8B — benchmark results

Alibaba's open 8B dense Qwen3 (April 2025) with switchable thinking/non-thinking modes and 119-language coverage. Provider: Alibaba. Released 2025-04-28. Access: Open.

Unified ELO 1428 ± 10, rank #1090 of 1776 rated models, from 581 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Benchmarking Large Language Models for Graphem100.15Direct (self-reported)100
Finetuning with Scientific Data Increases Hall67.1OFS (self-reported)100
MuPPET70.37Multi-Party (self-reported)100
Ukrainian LLM - Flores CS UK29.73Score (%)100
Ukrainian LLM - Flores DE UK38.83Score (%)100
Ukrainian LLM - Flores EN UK70.67Score (%)100
Ukrainian LLM - Flores HU UK26.38Score (%)100
Ukrainian LLM - Flores PL UK44.89Score (%)100
Ukrainian LLM - Flores RO UK41.19Score (%)100
Ukrainian LLM - Flores RU UK66.17Score (%)100
Ukrainian LLM - Flores SK UK36.12Score (%)100
Ukrainian LLM - Flores UK57.53Score (%)100

Interactive version: theaggregate.ai/model?slug=qwen-3-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.