Phi-3 Mini 128K Instruct: benchmark results
Provider: Microsoft. Released 2024-04-23. Access: Open.
Unified ELO 1406 ± 1, rank #1109 of 1392 rated models, from 98 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Cyber Bench Hub (v2) | 98 | Accuracy (%) | 90.5 |
| MERA - ruHumanEval | 38.35 | pass@1 (%) | 79.8 |
| Open LLM Leaderboard - BBH | 37.1 | Score | 76.6 |
| MERA - ruCodeEval | 36.28 | pass@1 (%) | 76.1 |
| BiGGen-Bench | 3.68 | Average Score (1-5) | 75.5 |
| Open LLM Leaderboard - GPQA | 9.06 | Score | 73.8 |
| Enkrypt AI - Jailbreak Risk | 5.53 | Risk Score | 71.9 |
| Open LLM Leaderboard - IFEval | 59.76 | Score | 71.7 |
| Enkrypt AI - Insecure Code Risk | 21.33 | Risk Score | 62.7 |
| Open LLM Leaderboard - MMLU-Pro | 30.38 | Score | 61.8 |
| Enkrypt AI - Safety Risk | 23.89 | Risk Score | 60.7 |
| Open LLM Leaderboard - MATH Level 5 | 14.05 | Score | 60.3 |
Interactive version: theaggregate.ai/model?slug=phi-3-mini-128k-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.