Orca-2-7B — benchmark results
Provider: Microsoft. Released 2023-11-14. Access: Open.
Unified ELO 1259 ± 41, rank #1602 of 1776 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MuSR | 24.09 | Score | 98.8 |
| Open CoT - LSAT Analytical Reasoning | 4.78 | CoT Gain (%) | 63 |
| Open LLM Leaderboard - BBH | 22.43 | Score | 33.6 |
| Open CoT - LogiQA | 2.4 | CoT Gain (%) | 30.5 |
| Open CoT - LogiQA 2 | 3.94 | CoT Gain (%) | 29.8 |
| Open LLM Leaderboard - MMLU-Pro | 14.65 | Score | 23.8 |
| Open CoT Leaderboard | 3.49 | Average CoT Gain (%) | 19.1 |
| Open CoT - LSAT Logical Reasoning | 3.73 | CoT Gain (%) | 16.8 |
| Open LLM Leaderboard - IFEval | 21.83 | Score | 14.6 |
| Open LLM Leaderboard - GPQA | 1.45 | Score | 14.5 |
| Open LLM Leaderboard - MATH Level 5 | 1.96 | Score | 13.8 |
| Open Korean LLM Leaderboard | 30.74 | Average Score (%) | 13.3 |
Interactive version: theaggregate.ai/model?slug=orca-2-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.