Orca-2-13B — benchmark results

Provider: Microsoft. Released 2023-11-14. Access: Open.

Unified ELO 1298 ± 39, rank #1538 of 1776 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR25.79Score99.5
Open LLM Leaderboard - BBH27.31Score43.4
Open CoT - LSAT Logical Reasoning7.84CoT Gain (%)37
Open CoT - LogiQA 24.58CoT Gain (%)36.3
Open LLM Leaderboard - GPQA4.03Score35.2
Open LLM Leaderboard - MMLU-Pro19.44Score29.9
Open LLM Leaderboard - IFEval31.28Score29
Open CoT - LogiQA1.92CoT Gain (%)23.7
Open CoT - LSAT Analytical Reasoning1.3CoT Gain (%)21.8
Open LLM Leaderboard - MATH Level 53.17Score19.7
Open CoT Leaderboard3.13Average CoT Gain (%)16.8
BiGGen-Bench2.49Average Score (1-5)13.7

Interactive version: theaggregate.ai/model?slug=orca-2-13b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.