Phi-3 Mini Instruct 3.8B — benchmark results

Provider: Microsoft. Released 2024-04-23. Access: Open.

Unified ELO 1113 ± 114, rank #1821 of 1841 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Humanity's Last Exam4.43Accuracy (%)20.9
AA-LCR2Score (self-reported)19.1
AA Long Context Reasoning2Accuracy (%)14.2
Artificial Analysis Intelligence Index4.59Intelligence Index13.5
AA MATH-50045.67Accuracy (%)12.1
AA MMLU-Pro43.51Accuracy (%)10.8
AA LiveCodeBench11.64Pass@1 (%)10.5
AA GPQA Diamond31.92Accuracy (%)9.2
Epoch AI - Scicode9.03Score8.6
AA IFBench23.88Accuracy (%)6.2
AA Terminal-Bench Hard0Accuracy (%)5.5
AA TAU-2 Bench0Accuracy (%)2.5

Interactive version: theaggregate.ai/model?slug=phi-3-mini-instruct-3-8b · How It Works · Data refreshed daily, snapshot 2026-07-25.