Qwen1.5-MoE-A2.7B: benchmark results

Provider: Alibaba. Released 2024-02-29. Access: Open.

Unified ELO 1393 ± 1, rank #1163 of 1392 rated models, from 65 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande64.17Accuracy (%)65
Open Japanese LLM - Xlsum JA Rouge127.11Score (%)61.9
Open Chinese LLM - CMMLU56.45Accuracy (%)61.1
Open Japanese LLM - Xlsum JA RougeLsum22.83Score (%)59.5
Open Chinese LLM - C-Eval Semantic70.25Accuracy (%)52.2
Open Japanese LLM - CG8.63Score (%)49.2
Open Japanese LLM - Mbpp Pylint Check23.49Score (%)46.6
Open Japanese LLM - Xlsum JA Bert Score JA F168.75Score (%)46.5
CyberMetric62.37Accuracy (%)45.8
Open LLM Leaderboard - MATH Level 59.29Score45.1
Open Chinese LLM - HellaSwag59.17Accuracy (%)43.6
Open Japanese LLM - Jsick Exact Match76.29Score (%)43

Interactive version: theaggregate.ai/model?slug=qwen1-5-moe-a2-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.