alpaca-native: benchmark results

Provider: Other. Released 2023-03-16. Access: Open.

Unified ELO 1317 ± 10, rank #2634 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Mathematics35Accuracy (%)75.2
MMLU-by-task - Machine Learning36.61Accuracy (%)67.9
MMLU-by-task - College Computer Science41Accuracy (%)57.5
MMLU-by-task - High School Physics31.13Accuracy (%)56
MMLU-by-task - ARC Challenge51.28Accuracy (%)55.9
MMLU-by-task - HellaSwag59.6Accuracy (%)55.1
LLM Trustworthy - Adversarial46.43Trust Score (%)54.2
MMLU-by-task - Anatomy45.93Accuracy (%)53.7
MMLU-by-task - High School Computer Science45Accuracy (%)52.2
MMLU-by-task - Global Facts33Accuracy (%)51.5
MMLU-by-task - Elementary Mathematics28.84Accuracy (%)50.6
LLM Trustworthy - Fairness92.63Trust Score (%)50

Interactive version: theaggregate.ai/model?slug=alpaca-native · How It Works · Data refreshed daily, snapshot 2026-09-23.