openbuddy-llama3-8B-v21.2-32k — benchmark results

Provider: Other. Released 2024-06-18. Access: Open.

Unified ELO 1399 ± 14, rank #1231 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval61.92Score74.1
Open Chinese LLM - C-Eval Semantic74.59Accuracy (%)64.1
Open Chinese LLM - CMMLU55.02Accuracy (%)59.1
Open Chinese LLM - GSM8K45.49Accuracy (%)48.7
Open Chinese LLM Leaderboard56.34Average Score (%)46.1
Open LLM Leaderboard - MMLU-Pro25.54Score46.1
Open LLM Leaderboard - BBH27.25Score43.3
Open Chinese LLM - TruthfulQA MC52.86Accuracy (%)42.3
Open LLM Leaderboard - MATH Level 57.85Score40.4
Open Chinese LLM - ARC Challenge48.72Accuracy (%)36.1
Open Chinese LLM - HellaSwag57.72Accuracy (%)34.4
Open LLM Leaderboard - GPQA3.91Score34.3

Interactive version: theaggregate.ai/model?slug=openbuddy-llama3-8b-v21-2-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.