Qwen1.5-MoE-A2.7B-Chat: benchmark results

Provider: Alibaba. Released 2024-03-14. Access: Open.

Unified ELO 1366 ± 1, rank #1227 of 1392 rated models, from 94 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - CMMLU54.31Accuracy (%)55.8
RewardBench Chat Hard63.16Accuracy (%)55.1
Open Chinese LLM - HellaSwag60.57Accuracy (%)54.3
Open Chinese LLM - WinoGrande62.59Accuracy (%)45.8
Open Chinese LLM - C-Eval Semantic67.78Accuracy (%)44.2
RewardBench66.44Score (%)44.1
RewardBench Reasoning77.4Accuracy (%)42.9
Open LLM Leaderboard - IFEval37.95Score37.2
Open LLM Leaderboard - MATH Level 56.34Score34.6
MERA - RWSD52.69Accuracy (%)34.2
Open LLM Leaderboard - MMLU-Pro21.37Score34
MERA - ruDetox12.54Joint Score (%)31

Interactive version: theaggregate.ai/model?slug=qwen1-5-moe-a2-7b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.