SuperNova-Medius — benchmark results

Arcee AI's 14B Qwen2.5-based model distilled from Llama 3.1 405B and Qwen2.5 72B teachers. Provider: Arcee AI. Released 2024-10-02. Access: Open.

Unified ELO 1570 ± 43, rank #566 of 1776 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard784.33Average Score (%)98.4
Open LLM Leaderboard - MATH Level 546.9Score94.8
Open CoT - LSAT Analytical Reasoning8.7CoT Gain (%)92.4
Open LLM Leaderboard - MMLU-Pro44.83Score88
Open LLM Leaderboard - BBH48.01Score87.9
Open CoT - LogiQA 214.12CoT Gain (%)87
Open CoT - LSAT Logical Reasoning18.24CoT Gain (%)85.9
Open LLM Leaderboard - IFEval71.84Score85.4
Open LLM Leaderboard - GPQA11.07Score81.7
Open CoT Leaderboard12.26Average CoT Gain (%)80.5
Open CoT - LSAT Reading Comprehension16.73CoT Gain (%)72.5
Open LLM Leaderboard - MuSR12.28Score66.9

Interactive version: theaggregate.ai/model?slug=supernova-medius · How the rankings work · Data refreshed daily, snapshot 2026-07-22.