WizardLM-13B-V1.2 — benchmark results

Provider: Microsoft. Released 2023-07-25. Access: Open.

Unified ELO 1280 ± 12, rank #1575 of 1776 rated models, from 71 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Mathematics32.22Accuracy (%)89.1
MMLU-by-task - Public Relations67.27Accuracy (%)87.6
MMLU-by-task - Security Studies66.94Accuracy (%)86.8
MMLU-by-task - Medical Genetics64Accuracy (%)86.3
MMLU-by-task - International Law75.21Accuracy (%)84.1
MMLU-by-task - Jurisprudence73.15Accuracy (%)83.9
MMLU-by-task - High School Computer Science60Accuracy (%)83.8
MMLU-by-task - Anatomy51.11Accuracy (%)82.4
MMLU-by-task - Professional Medicine56.25Accuracy (%)82.4
MMLU-by-task - Clinical Knowledge61.13Accuracy (%)82.3
MMLU-by-task - HellaSwag62.95Accuracy (%)80.5
MMLU-by-task - High School Microeconomics57.98Accuracy (%)80.5

Interactive version: theaggregate.ai/model?slug=wizardlm-13b-v1-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.