Chinese-Alpaca-2-13B: benchmark results
Provider: Other. Released 2023-08-14. Access: Open.
Unified ELO 1338 ± 11, rank #1341 of 1605 rated models, from 90 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - College Physics | 35.29 | Accuracy (%) | 88.8 |
| MMLU-by-task - Electrical Engineering | 54.48 | Accuracy (%) | 88.7 |
| MMLU-by-task - College Computer Science | 50 | Accuracy (%) | 88.1 |
| MMLU-by-task - High School Computer Science | 62 | Accuracy (%) | 87.2 |
| MMLU-by-task - Jurisprudence | 74.07 | Accuracy (%) | 85.9 |
| MMLU-by-task - High School Chemistry | 44.83 | Accuracy (%) | 84 |
| MMLU-by-task - High School Statistics | 47.22 | Accuracy (%) | 83.5 |
| MMLU-by-task - Astronomy | 58.55 | Accuracy (%) | 81.8 |
| MMLU-by-task - Business Ethics | 57 | Accuracy (%) | 81.1 |
| MMLU-by-task - High School Microeconomics | 57.98 | Accuracy (%) | 80.5 |
| MMLU-by-task - College Chemistry | 42 | Accuracy (%) | 80.4 |
| MMLU-by-task - College Medicine | 52.6 | Accuracy (%) | 80 |
Interactive version: theaggregate.ai/model?slug=chinese-alpaca-2-13b · How It Works · Data refreshed daily, snapshot 2026-09-26.