dolphin-2.9.1-mixtral-1x22B — benchmark results

Provider: Cognitive Computations. Released 2024-05-22. Access: Open.

Unified ELO 1239 ± 30, rank #1644 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC52.87Accuracy (%)42.9
Open Chinese LLM - GSM8K9.4Accuracy (%)8.5
Open Korean LLM Leaderboard28.95Average Score (%)7.5
Open Chinese LLM - ARC Challenge37.12Accuracy (%)4.7
Open Chinese LLM Leaderboard34.95Average Score (%)3.6
Open Chinese LLM - C-Eval Semantic31.39Accuracy (%)3
Open Chinese LLM - CMMLU30.77Accuracy (%)2.7
Open Chinese LLM - HellaSwag31.97Accuracy (%)2.1
Open Chinese LLM - WinoGrande51.14Accuracy (%)2.1

Interactive version: theaggregate.ai/model?slug=dolphin-2-9-1-mixtral-1x22b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.