Qwen 2 7B — benchmark results

Alibaba's Apache-2.0 7B Qwen2 base model (June 2024), the pretrained foundation for Qwen2-7B-Instruct. Provider: Alibaba. Released 2024-06-07. Access: Open.

Unified ELO 1422 ± 11, rank #1118 of 1776 rated models, from 93 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Xlsum JA Rouge131Score (%)86.1
Open Japanese LLM - Xlsum JA RougeLsum26.22Score (%)85.8
Open Chinese LLM - GSM8K60.12Accuracy (%)84.7
Open Japanese LLM - Xlsum JA Bert Score JA F170.26Score (%)82.5
Open Chinese LLM - WinoGrande67.32Accuracy (%)81.8
Open Japanese LLM - SUM10.93Score (%)79.8
European LLM Leaderboard - Accuracy54.24Average Accuracy (%)78.4
Open LLM Leaderboard - MuSR14.32Score78.3
Open Japanese LLM - Xlsum JA Rouge210.93Score (%)78.1
Open Chinese LLM Leaderboard63.5Average Score (%)76.6
Open Chinese LLM - CMMLU64.4Accuracy (%)76.3
Open LLM Leaderboard - MMLU-Pro35.37Score76

Interactive version: theaggregate.ai/model?slug=qwen-2-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.