Platypus2-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1362 ± 10, rank #2394 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Professional Law43.16Accuracy (%)81.4
MMLU-by-task - High School World History75.53Accuracy (%)79.2
MMLU-by-task - High School European History69.09Accuracy (%)77.8
MMLU-by-task - Conceptual Physics44.68Accuracy (%)74.4
MMLU-by-task - High School Chemistry41.87Accuracy (%)74.4
MMLU-by-task - Econometrics31.58Accuracy (%)73.2
MMLU-by-task - Moral Scenarios30.73Accuracy (%)68.8
MMLU-by-task - International Law69.42Accuracy (%)66.9
MMLU-by-task - Prehistory58.95Accuracy (%)66.5
MMLU-by-task - Philosophy60.45Accuracy (%)66.3
MMLU-by-task - Professional Psychology52.29Accuracy (%)66.3
MMLU-by-task - Public Relations60Accuracy (%)65.8

Interactive version: theaggregate.ai/model?slug=platypus2-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.