openbuddy-mistral-22B-v21.1-32k — benchmark results

Provider: Other. Released 2024-05-17. Access: Open.

Unified ELO 1142 ± 79, rank #1744 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC51.24Accuracy (%)26.4
Open Korean LLM Leaderboard30.13Average Score (%)11
Open Chinese LLM - WinoGrande51.07Accuracy (%)1.8
Open Chinese LLM - GSM8K0Accuracy (%)1.2
Open Chinese LLM - C-Eval Semantic24.24Accuracy (%)0.9
Open Chinese LLM - CMMLU25.48Accuracy (%)0.9
Open Chinese LLM - HellaSwag26.7Accuracy (%)0.9
Open Chinese LLM Leaderboard29.2Average Score (%)0.6
Open Chinese LLM - ARC Challenge25.68Accuracy (%)0.4

Interactive version: theaggregate.ai/model?slug=openbuddy-mistral-22b-v21-1-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.