Qwen3-4B-Base: benchmark results

Provider: Alibaba. Access: Open.

Unified ELO 1538 ± 23, rank #896 of 2656 rated models, from 161 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Swallow - Pre-trained English - HumanEval61.7Pass@1 (%)89.8
Open Arabic LLM - Arabic MMLU Philosophy (High School)69.23Accuracy (%)88.6
Open Arabic LLM - Aratrust MentalHealth94.74Accuracy (%)87.3
Swallow - Pre-trained English - MATH52Exact Match (%)84.7
Swallow - Pre-trained Japanese - JHumanEval53.7Pass@1 (%)83.7
Open Arabic LLM - Arabic MMLU HT Abstract Algebra38Accuracy (%)81.8
Open Arabic LLM - Aratrust Illegal92.45Accuracy (%)81.7
Open Arabic LLM - Arabic MMLU Geography (Primary School)75.44Accuracy (%)81.5
Open Arabic LLM - Aratrust Offensive89.86Accuracy (%)80.7
Open Arabic LLM - Arabic MMLU Computer Science (Primary School)76.32Accuracy (%)80.6
Open Arabic LLM - Arabic MMLU HT High School Physics49.67Accuracy (%)80.2
Open Arabic LLM - Arabic MMLU HT High School Mathematics40.37Accuracy (%)79.6

Interactive version: theaggregate.ai/model?slug=qwen3-4b-base · How It Works · Data refreshed daily, snapshot 2026-09-19.