ECE-TW3-JRGL-V1 — benchmark results

paloalma's SLERP merge of Senku-70B and miqu-1-70b by ECE engineering students with TW3 Partners, aimed at EQ-Bench performance. Provider: Other. Released 2024-04-03. Access: Open.

Unified ELO 1475 ± 16, rank #890 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR17.46Score88.6
Open LLM Leaderboard - GPQA12.98Score87
Open LLM Leaderboard - BBH46.7Score86.5
Open Chinese LLM - WinoGrande66.54Accuracy (%)78.9
Open Chinese LLM - TruthfulQA MC58.62Accuracy (%)78
Open LLM Leaderboard - MMLU-Pro35.79Score76.5
Open Chinese LLM Leaderboard63.3Average Score (%)76
Open Chinese LLM - ARC Challenge57.51Accuracy (%)75.2
Open Chinese LLM - CMMLU63.12Accuracy (%)73.1
Open Chinese LLM - GSM8K53.83Accuracy (%)73.1
Open Chinese LLM - HellaSwag63.09Accuracy (%)71.8
Open Chinese LLM - C-Eval Semantic80.4Accuracy (%)69.4

Interactive version: theaggregate.ai/model?slug=ece-tw3-jrgl-v1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.