Midnight-Miqu-70B-v1.5 — benchmark results

sophosympatheia's DARE-linear merge of Midnight-Miqu v1.0 with Tess 70B, a miqu-based 70B tuned for roleplay and storytelling with 32k context. Provider: Other. Released 2024-03-11. Access: Open.

Unified ELO 1433 ± 9, rank #1077 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - BBH38.54Score78.3
Open Chinese LLM - TruthfulQA MC58.1Accuracy (%)75.1
Open LLM Leaderboard - IFEval61.18Score73.3
Open Chinese LLM Leaderboard59.44Average Score (%)67.7
Open Chinese LLM - CMMLU59.23Accuracy (%)67.4
Open Chinese LLM - HellaSwag62.15Accuracy (%)66.8
Open LLM Leaderboard - MMLU-Pro31.39Score66.8
Open Chinese LLM - C-Eval Semantic74.62Accuracy (%)64.4
Open Chinese LLM - WinoGrande64.09Accuracy (%)64.2
Open Chinese LLM - ARC Challenge54.1Accuracy (%)63.2
Open LLM Leaderboard - MuSR11.65Score62.2
Open LLM Leaderboard - GPQA6.15Score51.6

Interactive version: theaggregate.ai/model?slug=midnight-miqu-70b-v1-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.