MultiVerse_70B — benchmark results

MTS AI's chat model built from Qwen 72B with an unpublished proprietary 'multiverse' training method, despite the 70B name. Provider: Other. Released 2024-03-25. Access: Open.

Unified ELO 1539 ± 18, rank #652 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic91.53Accuracy (%)99.4
Open Chinese LLM - ARC Challenge69.28Accuracy (%)98.8
Open Chinese LLM - HellaSwag77.08Accuracy (%)98.5
Open Chinese LLM Leaderboard73.8Average Score (%)98.5
Open Chinese LLM - WinoGrande71.74Accuracy (%)97.6
Open Chinese LLM - TruthfulQA MC66.1Accuracy (%)97
Open Chinese LLM - GSM8K69.29Accuracy (%)94.2
Open Chinese LLM - CMMLU71.61Accuracy (%)92.4
Open LLM Leaderboard - MuSR18.82Score91.9
Open LLM Leaderboard - GPQA13.87Score89.1
Open LLM Leaderboard - MMLU-Pro42.89Score86.9
Open LLM Leaderboard - BBH46.14Score86.1

Interactive version: theaggregate.ai/model?slug=multiverse-70b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.