Chinese-Alpaca-2-13B: benchmark results

Provider: Other. Released 2023-08-14. Access: Open.

Unified ELO 1338 ± 11, rank #1341 of 1605 rated models, from 90 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Physics35.29Accuracy (%)88.8
MMLU-by-task - Electrical Engineering54.48Accuracy (%)88.7
MMLU-by-task - College Computer Science50Accuracy (%)88.1
MMLU-by-task - High School Computer Science62Accuracy (%)87.2
MMLU-by-task - Jurisprudence74.07Accuracy (%)85.9
MMLU-by-task - High School Chemistry44.83Accuracy (%)84
MMLU-by-task - High School Statistics47.22Accuracy (%)83.5
MMLU-by-task - Astronomy58.55Accuracy (%)81.8
MMLU-by-task - Business Ethics57Accuracy (%)81.1
MMLU-by-task - High School Microeconomics57.98Accuracy (%)80.5
MMLU-by-task - College Chemistry42Accuracy (%)80.4
MMLU-by-task - College Medicine52.6Accuracy (%)80

Interactive version: theaggregate.ai/model?slug=chinese-alpaca-2-13b · How It Works · Data refreshed daily, snapshot 2026-09-26.