Qwen1.5-MoE-A2.7B-Chat — benchmark results

Provider: Alibaba. Released 2024-03-14. Access: Open.

Unified ELO 1308 ± 15, rank #1514 of 1776 rated models, from 71 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - CMMLU54.31Accuracy (%)55.8
RewardBench Chat Hard63.16Accuracy (%)55.1
Open Chinese LLM - HellaSwag60.57Accuracy (%)54.3
Open Chinese LLM - WinoGrande62.59Accuracy (%)45.8
Open Chinese LLM - C-Eval Semantic67.78Accuracy (%)44.2
RewardBench66.44Score (%)44.1
RewardBench Reasoning77.4Accuracy (%)42.9
Open LLM Leaderboard - IFEval37.95Score37.2
Open LLM Leaderboard - MATH Level 56.34Score34.6
Open LLM Leaderboard - MMLU-Pro21.37Score34
Open LLM Leaderboard - MuSR6.33Score30.3
Open LLM Leaderboard - BBH20.04Score30

Interactive version: theaggregate.ai/model?slug=qwen1-5-moe-a2-7b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.