Qwen2.5-7B-Instruct-1M: benchmark results

Provider: Alibaba. Access: Open.

Unified ELO 1481 ± 1, rank #781 of 1392 rated models, from 64 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 543.35Score92.4
Open LLM Leaderboard - IFEval74.48Score89.6
Open Japanese LLM - Jsick Exact Match84.29Score (%)87.7
Open Japanese LLM - Wiki PAS SET F18.44Score (%)81
RULER91.8Avg Accuracy (%)80
Enkrypt AI - Safety Risk21.86Risk Score74.8
Open LLM Leaderboard - BBH35.03Score70.5
Open Japanese LLM - Jamp Exact Match65.23Score (%)64.8
Open Japanese LLM - RC90.74Score (%)63
Enkrypt AI - Insecure Code Risk24Risk Score59.8
Open Japanese LLM - Jnli Exact Match82.54Score (%)58.7
Open Japanese LLM - Jsts Spearman85.71Score (%)53.6

Interactive version: theaggregate.ai/model?slug=qwen2-5-7b-instruct-1m · How It Works · Data refreshed daily, snapshot 2026-09-05.