14B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1471 ± 20, rank #1552 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU65.86Accuracy (%) (5-shot)85.5
Open LLM Leaderboard v1 - GSM8K58.61Accuracy (%) (5-shot)70.4
Open LLM Leaderboard - GPQA30.29Score59.2
Open LLM Leaderboard - MuSR41.55Score55.6
Open LLM Leaderboard - MMLU-Pro32.21Score44.2
Open LLM Leaderboard v1 - WinoGrande74.9Accuracy (%) (5-shot)39.4
Open LLM Leaderboard - MATH Level 57.55Score39.3
Open LLM Leaderboard - BBH47Score39.1
Open LLM Leaderboard v1 - TruthfulQA MC247.75MC2 (%) (0-shot)38.6
Open LLM Leaderboard v1 - HellaSwag79.08Normalized accuracy (%) (10-shot)36.7
Open LLM Leaderboard v1 - ARC Challenge56.66Normalized accuracy (%) (25-shot)35.9
Open LLM Leaderboard - IFEval27.88Score25

Interactive version: theaggregate.ai/model?slug=14b · How It Works · Data refreshed daily, snapshot 2026-09-23.