openbuddy-llama3-8B-v21.1-8k — benchmark results

OpenBuddy's multilingual chatbot fine-tune of Llama 3 8B with an 8k context, tuned for English and Chinese conversation. Provider: Other. Released 2024-04-20. Access: Open.

Unified ELO 1430 ± 24, rank #1087 of 1776 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LSAT Analytical Reasoning7.83CoT Gain (%)86.3
Open CoT - LSAT Reading Comprehension18.96CoT Gain (%)82.1
Open Korean LLM Leaderboard393.17Average Score (%)76.3
Open CoT Leaderboard10.81Average CoT Gain (%)71
Open CoT - LSAT Logical Reasoning14.12CoT Gain (%)68.3
Open LLM Leaderboard - IFEval55.7Score67.5
Open CoT - LogiQA 28.65CoT Gain (%)60.3
Open CoT - LogiQA4.47CoT Gain (%)57.6
Open LLM Leaderboard - MuSR10.35Score51.8
Open LLM Leaderboard - BBH26.12Score40.6
Open LLM Leaderboard - MMLU-Pro21.72Score35
Open LLM Leaderboard - GPQA2.8Score25.8

Interactive version: theaggregate.ai/model?slug=openbuddy-llama3-8b-v21-1-8k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.