Slerp-CM-mist-dpo: benchmark results

Provider: Other. Access: Open.

Unified ELO 1468 ± 32, rank #1391 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC59.82Accuracy (%)83.1
Open Portuguese LLM - FaQuAD NLI78.05Macro F1 (%)82.5
Open Portuguese LLM - ASSIN2 RTE92.4Macro F1 (%)78.7
Open Portuguese LLM - ENEM65.43Accuracy (%)61.7
Open Portuguese LLM - BLUEX53.69Accuracy (%)56.8
Open Chinese LLM - GSM8K47.23Accuracy (%)56.1
Open Portuguese LLM - OAB Exams42.6Accuracy (%)52.2
Open Chinese LLM - ARC Challenge49.83Accuracy (%)40.8
Open Chinese LLM Leaderboard55.25Average Score (%)38.6
Open Chinese LLM - HellaSwag57.8Accuracy (%)34.7
Open Chinese LLM - C-Eval Semantic62.58Accuracy (%)30.9
Open Chinese LLM - CMMLU48.22Accuracy (%)29.1

Interactive version: theaggregate.ai/model?slug=slerp-cm-mist-dpo · How It Works · Data refreshed daily, snapshot 2026-09-19.