openbuddy-llama2-13B-v8.1-fp16: benchmark results
Provider: Other. Access: Open.
Unified ELO 1396 ± 10, rank #2172 of 2928 rated models, from 78 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - High School Mathematics | 33.33 | Accuracy (%) | 93.3 |
| MMLU-by-task - Human Aging | 69.96 | Accuracy (%) | 91 |
| MMLU-by-task - Business Ethics | 60 | Accuracy (%) | 87.7 |
| MMLU-by-task - International Law | 76.03 | Accuracy (%) | 85.6 |
| MMLU-by-task - Public Relations | 66.36 | Accuracy (%) | 85.5 |
| MMLU-by-task - High School Computer Science | 60 | Accuracy (%) | 83.8 |
| MMLU-by-task - College Physics | 33.33 | Accuracy (%) | 83.6 |
| MMLU-by-task - Electrical Engineering | 52.41 | Accuracy (%) | 83.6 |
| MMLU-by-task - Computer Security | 70 | Accuracy (%) | 82.6 |
| MMLU-by-task - Logical Fallacies | 68.71 | Accuracy (%) | 82.5 |
| MMLU-by-task - Marketing | 82.48 | Accuracy (%) | 82.5 |
| MMLU-by-task - Abstract Algebra | 34 | Accuracy (%) | 82.1 |
Interactive version: theaggregate.ai/model?slug=openbuddy-llama2-13b-v8-1-fp16 · How It Works · Data refreshed daily, snapshot 2026-09-23.