ECE-TW3-JRGL-V5 — benchmark results

paloalma's mergekit combination of two Qwen-72B derivatives, MoMo-72B DPO and Alpaca Dragon 72B, in the ECE-TW3-JRGL merge series. Provider: Other. Released 2024-04-10. Access: Open.

Unified ELO 1513 ± 21, rank #759 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic90.81Accuracy (%)97.3
Open Chinese LLM Leaderboard71.22Average Score (%)97.3
Open Chinese LLM - HellaSwag72.92Accuracy (%)97
Open Chinese LLM - ARC Challenge64.16Accuracy (%)95.5
Open Chinese LLM - GSM8K69.37Accuracy (%)94.7
Open Chinese LLM - WinoGrande69.22Accuracy (%)89.6
Open Chinese LLM - CMMLU70.8Accuracy (%)88.4
Open Chinese LLM - TruthfulQA MC61.27Accuracy (%)88.4
Open LLM Leaderboard - MuSR16.89Score87.2
Open LLM Leaderboard - MMLU-Pro40.53Score85.5
Open LLM Leaderboard - GPQA12.19Score84.9
Open LLM Leaderboard - BBH43.46Score82.7

Interactive version: theaggregate.ai/model?slug=ece-tw3-jrgl-v5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.