LIMA2-7B-hf: benchmark results

Provider: Other. Access: Open.

Unified ELO 1321 ± 10, rank #2618 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Chemistry43Accuracy (%)83.5
MMLU-by-task - High School Physics35.1Accuracy (%)81.9
MMLU-by-task - HellaSwag62.35Accuracy (%)75.8
MMLU-by-task - High School Mathematics29.26Accuracy (%)70.5
MMLU-by-task - Formal Logic34.13Accuracy (%)66.1
MMLU-by-task - College Mathematics33Accuracy (%)61.7
MMLU-by-task - Sociology66.67Accuracy (%)60.3
MMLU-by-task - College Medicine43.35Accuracy (%)57.9
MMLU-by-task - Human Sexuality57.25Accuracy (%)57.9
MMLU-by-task - Professional Medicine49.26Accuracy (%)57.8
MMLU-by-task - TruthfulQA MC129.74Accuracy (%)56.4
MMLU-by-task - College Physics25.49Accuracy (%)53.1

Interactive version: theaggregate.ai/model?slug=lima2-7b-hf · How It Works · Data refreshed daily, snapshot 2026-09-23.