openbuddy-llama2-13B-v8.1-fp16: benchmark results

Provider: Other. Access: Open.

Unified ELO 1396 ± 10, rank #2172 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Mathematics33.33Accuracy (%)93.3
MMLU-by-task - Human Aging69.96Accuracy (%)91
MMLU-by-task - Business Ethics60Accuracy (%)87.7
MMLU-by-task - International Law76.03Accuracy (%)85.6
MMLU-by-task - Public Relations66.36Accuracy (%)85.5
MMLU-by-task - High School Computer Science60Accuracy (%)83.8
MMLU-by-task - College Physics33.33Accuracy (%)83.6
MMLU-by-task - Electrical Engineering52.41Accuracy (%)83.6
MMLU-by-task - Computer Security70Accuracy (%)82.6
MMLU-by-task - Logical Fallacies68.71Accuracy (%)82.5
MMLU-by-task - Marketing82.48Accuracy (%)82.5
MMLU-by-task - Abstract Algebra34Accuracy (%)82.1

Interactive version: theaggregate.ai/model?slug=openbuddy-llama2-13b-v8-1-fp16 · How It Works · Data refreshed daily, snapshot 2026-09-23.