Orca-2-7B — benchmark results

Provider: Microsoft. Released 2023-11-14. Access: Open.

Unified ELO 1259 ± 41, rank #1602 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR24.09Score98.8
Open CoT - LSAT Analytical Reasoning4.78CoT Gain (%)63
Open LLM Leaderboard - BBH22.43Score33.6
Open CoT - LogiQA2.4CoT Gain (%)30.5
Open CoT - LogiQA 23.94CoT Gain (%)29.8
Open LLM Leaderboard - MMLU-Pro14.65Score23.8
Open CoT Leaderboard3.49Average CoT Gain (%)19.1
Open CoT - LSAT Logical Reasoning3.73CoT Gain (%)16.8
Open LLM Leaderboard - IFEval21.83Score14.6
Open LLM Leaderboard - GPQA1.45Score14.5
Open LLM Leaderboard - MATH Level 51.96Score13.8
Open Korean LLM Leaderboard30.74Average Score (%)13.3

Interactive version: theaggregate.ai/model?slug=orca-2-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.