WizardLM-13B-V1.2 — benchmark results
Provider: Microsoft. Released 2023-07-25. Access: Open.
Unified ELO 1280 ± 12, rank #1575 of 1776 rated models, from 71 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - High School Mathematics | 32.22 | Accuracy (%) | 89.1 |
| MMLU-by-task - Public Relations | 67.27 | Accuracy (%) | 87.6 |
| MMLU-by-task - Security Studies | 66.94 | Accuracy (%) | 86.8 |
| MMLU-by-task - Medical Genetics | 64 | Accuracy (%) | 86.3 |
| MMLU-by-task - International Law | 75.21 | Accuracy (%) | 84.1 |
| MMLU-by-task - Jurisprudence | 73.15 | Accuracy (%) | 83.9 |
| MMLU-by-task - High School Computer Science | 60 | Accuracy (%) | 83.8 |
| MMLU-by-task - Anatomy | 51.11 | Accuracy (%) | 82.4 |
| MMLU-by-task - Professional Medicine | 56.25 | Accuracy (%) | 82.4 |
| MMLU-by-task - Clinical Knowledge | 61.13 | Accuracy (%) | 82.3 |
| MMLU-by-task - HellaSwag | 62.95 | Accuracy (%) | 80.5 |
| MMLU-by-task - High School Microeconomics | 57.98 | Accuracy (%) | 80.5 |
Interactive version: theaggregate.ai/model?slug=wizardlm-13b-v1-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.