openbuddy-llama3.1-8B-v22.3-131k — benchmark results

OpenBuddy's multilingual chatbot fine-tune of Llama 3.1 8B Instruct with a 131k context. Provider: Other. Released 2024-08-16. Access: Open.

Unified ELO 1423 ± 21, rank #1116 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard461.61Average Score (%)83.7
Open LLM Leaderboard - IFEval59.97Score71.8
Open LLM Leaderboard - MATH Level 512.08Score54.3
Open LLM Leaderboard - BBH30.32Score52.8
Open LLM Leaderboard - MMLU-Pro25.3Score45.3
Open LLM Leaderboard - MuSR8.32Score39.4
Open LLM Leaderboard - GPQA3.91Score34.3

Interactive version: theaggregate.ai/model?slug=openbuddy-llama3-1-8b-v22-3-131k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.