Phi-1.5 — benchmark results

Provider: Microsoft. Released 2023-09-11. Access: Open.

Unified ELO 1168 ± 23, rank #1720 of 1776 rated models, from 123 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Mathematics41Accuracy (%)97.3
MMLU-by-task - Abstract Algebra34Accuracy (%)82.1
AI Energy Score (Text Generation)5Energy Score (1-5)79.5
MMLU-by-task - College Computer Science46Accuracy (%)75.4
MMLU-by-task - Machine Learning38.39Accuracy (%)75.4
MMLU-by-task - Electrical Engineering48.28Accuracy (%)68.4
MMLU-by-task - College Physics27.45Accuracy (%)62.9
MMLU-by-task - Business Ethics52Accuracy (%)61.7
MMLU-by-task - Moral Disputes54.91Accuracy (%)61.5
MMLU-by-task - Elementary Mathematics30.16Accuracy (%)57.8
MMLU-by-task - Sociology64.68Accuracy (%)56.8
MMLU-by-task - High School Microeconomics45.38Accuracy (%)56.1

Interactive version: theaggregate.ai/model?slug=phi-1-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.