dolphin-2.9.1-mixtral-1x22B: benchmark results

Provider: Cognitive Computations. Released 2024-05-22. Access: Open.

Unified ELO 1296 ± 1, rank #1351 of 1392 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC52.87Accuracy (%)42.9
Open Chinese LLM - GSM8K9.4Accuracy (%)8.5
Open Chinese LLM - ARC Challenge37.12Accuracy (%)4.7
Open Chinese LLM Leaderboard34.95Average Score (%)3.6
Open Korean LLM Leaderboard28.95Average Score (%)3.3
Open Chinese LLM - C-Eval Semantic31.39Accuracy (%)3
Open Chinese LLM - CMMLU30.77Accuracy (%)2.7
Open Chinese LLM - HellaSwag31.97Accuracy (%)2.1
Open Chinese LLM - WinoGrande51.14Accuracy (%)2.1

Interactive version: theaggregate.ai/model?slug=dolphin-2-9-1-mixtral-1x22b · How It Works · Data refreshed daily, snapshot 2026-09-05.