LIMA2-13B-hf: benchmark results
Provider: Other. Access: Open.
Unified ELO 1377 ± 10, rank #2303 of 2928 rated models, from 78 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - HellaSwag | 65.25 | Accuracy (%) | 89.8 |
| MMLU-by-task - High School Statistics | 47.22 | Accuracy (%) | 83.4 |
| MMLU-by-task - Astronomy | 57.24 | Accuracy (%) | 79.6 |
| MMLU-by-task - Formal Logic | 37.3 | Accuracy (%) | 79.6 |
| MMLU-by-task - High School Physics | 34.44 | Accuracy (%) | 78.6 |
| MMLU-by-task - High School Geography | 70.71 | Accuracy (%) | 77.2 |
| MMLU-by-task - Anatomy | 49.63 | Accuracy (%) | 75.8 |
| MMLU-by-task - Moral Scenarios | 36.09 | Accuracy (%) | 75.5 |
| MMLU-by-task - Public Relations | 62.73 | Accuracy (%) | 74.2 |
| MMLU-by-task - College Chemistry | 40 | Accuracy (%) | 73.7 |
| MMLU-by-task - Econometrics | 31.58 | Accuracy (%) | 73.2 |
| MMLU-by-task - Professional Medicine | 52.94 | Accuracy (%) | 73.1 |
Interactive version: theaggregate.ai/model?slug=lima2-13b-hf · How It Works · Data refreshed daily, snapshot 2026-09-23.