WizardLM-2-7B — benchmark results
Provider: Microsoft. Released 2024-04-16. Access: Open.
Unified ELO 1325 ± 19, rank #1483 of 1776 rated models, from 16 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 45.83 | Score | 51.4 |
| Open PL LLM - Multiple Choice | 35.86 | Average Multiple-Choice Score (%) | 44.8 |
| Open PL LLM Leaderboard | 39.15 | Average Score (%) | 42.7 |
| Open LLM Leaderboard - GPQA | 4.92 | Score | 41.7 |
| Open PL LLM - Generative | 41.68 | Average Generative Score (%) | 39.9 |
| Open PL LLM - RAG | 48.61 | Average RAG Score (%) | 36.7 |
| Open LLM Leaderboard - MuSR | 7.53 | Score | 35.1 |
| PECC - Project Euler (Story) | 0.87 | Solve rate (%) | 30 |
| LLMZSZL Leaderboard | 38.23 | Score | 29.6 |
| Open LLM Leaderboard - MMLU-Pro | 18.45 | Score | 28.1 |
| Open LLM Leaderboard - MATH Level 5 | 3.32 | Score | 20.2 |
| PECC - Advent of Code | 5.87 | Solve rate (%) | 20 |
Interactive version: theaggregate.ai/model?slug=wizardlm-2-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.