wizardlm-13B: benchmark results

Provider: Microsoft. Released 2023-05-13. Access: Open.

Unified ELO 1397 ± 20, rank #1927 of 2656 rated models, from 27 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MoralChoice99.1MoralChoice Acc (%)62.5
MT-Bench6.35MT-Bench average score (points)54.5
BenchBench42.77Aggregate Score (%)44.1
AlpacaEval62.55Length-Controlled Win Rate (%)42.1
T-Eval49Overall Score (%)40
AlpacaEval 1.075.31Win Rate (%)32.7
AlpacaEval 2.09.83LC Win Rate (%)21.6
Chatbot Arena (Text - Writing, Literature & Language)1153Arena Score13.4
Chatbot Arena (Text - Creative Writing)1140Arena Score13.3
Chatbot Arena (Text - Entertainment, Sports & Media)1140Arena Score12.7
Chatbot Arena (Text - Non-English)1106Arena Score11.1
Chatbot Arena (Text - Instruction Following)1124Arena Score9.9

Interactive version: theaggregate.ai/model?slug=wizardlm-13b · How It Works · Data refreshed daily, snapshot 2026-09-19.