T.E-8.1 — benchmark results

Cran-May's bilingual Chinese-English roleplay fine-tune of Qwen2.5 7B Instruct. Provider: Other. Released 2024-09-27. Access: Open.

Unified ELO 1517 ± 10, rank #739 of 1776 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 544.56Score93.2
Open Korean LLM Leaderboard580.12Average Score (%)92.7
Open LLM Leaderboard - IFEval70.77Score84
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)51.23Accuracy (%)82.7
Open LLM Leaderboard - MuSR15.32Score82.6
Open LLM Leaderboard - MMLU-Pro38.14Score82.2
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task92Accuracy (%)81.2
Open Arabic LLM - Madinah QA Arabic Language (Grammar)54.25Accuracy (%)79
Open Arabic LLM - Aratrust Privacy94.74Accuracy (%)78.3
Open Arabic LLM - Arabic MMLU Math (Primary School)71.15Accuracy (%)78.1
Open Arabic LLM - Madinah QA Average62.34Accuracy (%)77.8
Open LLM Leaderboard - BBH37.02Score76.5

Interactive version: theaggregate.ai/model?slug=t-e-8-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.