TW3-JRGL-v2 — benchmark results

Mergekit merge of Rhea-72B and MultiVerse_70B by paloalma, a student project from France's ECE engineering school with TW3 Partners. Provider: Other. Released 2024-04-01. Access: Open.

Unified ELO 1546 ± 19, rank #635 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - ARC Challenge71.16Accuracy (%)99.9
Open Chinese LLM - HellaSwag78.17Accuracy (%)99.7
Open Chinese LLM Leaderboard74.66Average Score (%)99.7
Open Chinese LLM - C-Eval Semantic91.28Accuracy (%)98.8
Open Chinese LLM - CMMLU73.73Accuracy (%)98.2
Open Chinese LLM - TruthfulQA MC66.26Accuracy (%)97.3
Open Chinese LLM - WinoGrande71.67Accuracy (%)97.3
Open Chinese LLM - GSM8K70.36Accuracy (%)96.9
Open LLM Leaderboard - MuSR20.7Score95.9
Open LLM Leaderboard - GPQA14.54Score90.4
Open LLM Leaderboard - MMLU-Pro42.87Score86.9
Open LLM Leaderboard - BBH45.61Score85.7

Interactive version: theaggregate.ai/model?slug=tw3-jrgl-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.