LIMA-13B-hf: benchmark results

Provider: Other. Access: Open.

Unified ELO 1358 ± 10, rank #2426 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Mathematics38Accuracy (%)89.4
MMLU-by-task - US Foreign Policy82Accuracy (%)78.9
MMLU-by-task - Formal Logic36.51Accuracy (%)76.5
MMLU-by-task - Abstract Algebra33Accuracy (%)75.6
MMLU-by-task - HellaSwag61.98Accuracy (%)73.2
MMLU-by-task - Human Sexuality61.83Accuracy (%)70.9
MMLU-by-task - High School World History72.15Accuracy (%)67.5
MMLU-by-task - ARC Challenge54.27Accuracy (%)65.9
MMLU-by-task - Astronomy51.32Accuracy (%)65.1
MMLU-by-task - Global Facts35Accuracy (%)64.1
MMLU-by-task - Professional Medicine50.74Accuracy (%)62.7
MMLU-by-task - Electrical Engineering46.9Accuracy (%)61.9

Interactive version: theaggregate.ai/model?slug=lima-13b-hf · How It Works · Data refreshed daily, snapshot 2026-09-23.