Phi-3 Mini 128K Instruct: benchmark results

Provider: Microsoft. Released 2024-04-23. Access: Open.

Unified ELO 1406 ± 1, rank #1109 of 1392 rated models, from 98 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Cyber Bench Hub (v2)98Accuracy (%)90.5
MERA - ruHumanEval38.35pass@1 (%)79.8
Open LLM Leaderboard - BBH37.1Score76.6
MERA - ruCodeEval36.28pass@1 (%)76.1
BiGGen-Bench3.68Average Score (1-5)75.5
Open LLM Leaderboard - GPQA9.06Score73.8
Enkrypt AI - Jailbreak Risk5.53Risk Score71.9
Open LLM Leaderboard - IFEval59.76Score71.7
Enkrypt AI - Insecure Code Risk21.33Risk Score62.7
Open LLM Leaderboard - MMLU-Pro30.38Score61.8
Enkrypt AI - Safety Risk23.89Risk Score60.7
Open LLM Leaderboard - MATH Level 514.05Score60.3

Interactive version: theaggregate.ai/model?slug=phi-3-mini-128k-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.