Orca-2-13B — benchmark results
Provider: Microsoft. Released 2023-11-14. Access: Open.
Unified ELO 1298 ± 39, rank #1538 of 1776 rated models, from 13 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MuSR | 25.79 | Score | 99.5 |
| Open LLM Leaderboard - BBH | 27.31 | Score | 43.4 |
| Open CoT - LSAT Logical Reasoning | 7.84 | CoT Gain (%) | 37 |
| Open CoT - LogiQA 2 | 4.58 | CoT Gain (%) | 36.3 |
| Open LLM Leaderboard - GPQA | 4.03 | Score | 35.2 |
| Open LLM Leaderboard - MMLU-Pro | 19.44 | Score | 29.9 |
| Open LLM Leaderboard - IFEval | 31.28 | Score | 29 |
| Open CoT - LogiQA | 1.92 | CoT Gain (%) | 23.7 |
| Open CoT - LSAT Analytical Reasoning | 1.3 | CoT Gain (%) | 21.8 |
| Open LLM Leaderboard - MATH Level 5 | 3.17 | Score | 19.7 |
| Open CoT Leaderboard | 3.13 | Average CoT Gain (%) | 16.8 |
| BiGGen-Bench | 2.49 | Average Score (1-5) | 13.7 |
Interactive version: theaggregate.ai/model?slug=orca-2-13b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.