Herodotos-14B: benchmark results

Triangle104's community TIES merge of Qwen2.5 14B fine-tunes (Lumen, Coder 14B, DRT-o1). Provider: Other. Released 2025-01-13. Access: Open.

Unified ELO 1545 ± 1, rank #460 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 550.45Score97.2
Open LLM Leaderboard - MuSR19.88Score94.6
Open LLM Leaderboard - GPQA16.44Score93.2
Open LLM Leaderboard - MMLU-Pro47.67Score92.4
Open LLM Leaderboard - BBH48.91Score89.4
UGI - Willingness (W/10)6W/10 Score54.2
Open LLM Leaderboard - IFEval46.67Score53.2
UGI Leaderboard33.6UGI Score46.1
UGI - Writing26.22Writing Score25.6
UGI - Natural Intelligence15.46NatInt Score20.7

Interactive version: theaggregate.ai/model?slug=herodotos-14b · How It Works · Data refreshed daily, snapshot 2026-09-05.