RYS-Phi-3-medium-4k-instruct — benchmark results

dnhkng's RYS-upscaled variant of Microsoft's Phi-3-medium-4k-instruct, enlarged to ~18B params via an experimental layer-expansion technique. Provider: Other. Released 2024-08-06. Access: Open.

Unified ELO 1466 ± 44, rank #928 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA13.98Score89.4
Open LLM Leaderboard - MMLU-Pro42.74Score86.8
Open LLM Leaderboard - BBH46.75Score86.7
Open LLM Leaderboard - MATH Level 516.09Score64
Open LLM Leaderboard - MuSR11.09Score57.2
Open LLM Leaderboard - IFEval43.91Score47.1
Open PL LLM - Generative30.59Average Generative Score (%)29.7
Open PL LLM Leaderboard22.04Average Score (%)26.9
Open PL LLM - Multiple Choice10.93Average Multiple-Choice Score (%)25.5
Open PL LLM - RAG37.23Average RAG Score (%)25.2

Interactive version: theaggregate.ai/model?slug=rys-phi-3-medium-4k-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.