zephyr-7B-alpha-dare-0.85: benchmark results

Provider: HuggingFace. Access: Open.

Unified ELO 1405 ± 17, rank #1867 of 2656 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-IFEval35.24Strict accuracy, prompt/instruction mean (%)72.5
Open Korean LLM - Ko-GSM8K (flexible extract)26.61Exact match, flexible extract (%)60.6
Open Portuguese LLM - OAB Exams43.6Accuracy (%)56.1
Open Portuguese LLM - FaQuAD NLI67.32Macro F1 (%)53.7
Open Portuguese LLM - BLUEX52.02Accuracy (%)51.4
Open Portuguese LLM - ENEM61.44Accuracy (%)49.4
Open Korean LLM - KorNAT-Helpful46.45Normalized accuracy (%)46.5
Open Korean LLM - Ko-Winogrande59.27Accuracy (%)45
Open Korean LLM Leaderboard33.76Average Score (%)43.9
Open Ko-LLM Leaderboard33.76Average (%)43.8
Open Portuguese LLM - ASSIN2 RTE87.87Macro F1 (%)42.4
Open Korean LLM - Ko-GPQA-Diamond21.21Normalized accuracy (%)24

Interactive version: theaggregate.ai/model?slug=zephyr-7b-alpha-dare-0-85 · How It Works · Data refreshed daily, snapshot 2026-09-19.