Platypus2-7B: benchmark results
Provider: Other. Access: Open.
Unified ELO 1362 ± 10, rank #2394 of 2928 rated models, from 78 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - Professional Law | 43.16 | Accuracy (%) | 81.4 |
| MMLU-by-task - High School World History | 75.53 | Accuracy (%) | 79.2 |
| MMLU-by-task - High School European History | 69.09 | Accuracy (%) | 77.8 |
| MMLU-by-task - Conceptual Physics | 44.68 | Accuracy (%) | 74.4 |
| MMLU-by-task - High School Chemistry | 41.87 | Accuracy (%) | 74.4 |
| MMLU-by-task - Econometrics | 31.58 | Accuracy (%) | 73.2 |
| MMLU-by-task - Moral Scenarios | 30.73 | Accuracy (%) | 68.8 |
| MMLU-by-task - International Law | 69.42 | Accuracy (%) | 66.9 |
| MMLU-by-task - Prehistory | 58.95 | Accuracy (%) | 66.5 |
| MMLU-by-task - Philosophy | 60.45 | Accuracy (%) | 66.3 |
| MMLU-by-task - Professional Psychology | 52.29 | Accuracy (%) | 66.3 |
| MMLU-by-task - Public Relations | 60 | Accuracy (%) | 65.8 |
Interactive version: theaggregate.ai/model?slug=platypus2-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.