LIMA2-13B-hf: benchmark results

Provider: Other. Access: Open.

Unified ELO 1377 ± 10, rank #2303 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - HellaSwag65.25Accuracy (%)89.8
MMLU-by-task - High School Statistics47.22Accuracy (%)83.4
MMLU-by-task - Astronomy57.24Accuracy (%)79.6
MMLU-by-task - Formal Logic37.3Accuracy (%)79.6
MMLU-by-task - High School Physics34.44Accuracy (%)78.6
MMLU-by-task - High School Geography70.71Accuracy (%)77.2
MMLU-by-task - Anatomy49.63Accuracy (%)75.8
MMLU-by-task - Moral Scenarios36.09Accuracy (%)75.5
MMLU-by-task - Public Relations62.73Accuracy (%)74.2
MMLU-by-task - College Chemistry40Accuracy (%)73.7
MMLU-by-task - Econometrics31.58Accuracy (%)73.2
MMLU-by-task - Professional Medicine52.94Accuracy (%)73.1

Interactive version: theaggregate.ai/model?slug=lima2-13b-hf · How It Works · Data refreshed daily, snapshot 2026-09-23.