T.E-8.1 — benchmark results
Cran-May's bilingual Chinese-English roleplay fine-tune of Qwen2.5 7B Instruct. Provider: Other. Released 2024-09-27. Access: Open.
Unified ELO 1517 ± 10, rank #739 of 1776 rated models, from 130 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MATH Level 5 | 44.56 | Score | 93.2 |
| Open Korean LLM Leaderboard | 580.12 | Average Score (%) | 92.7 |
| Open LLM Leaderboard - IFEval | 70.77 | Score | 84 |
| Open Arabic LLM - Arabic MMLU Arabic Language (Grammar) | 51.23 | Accuracy (%) | 82.7 |
| Open LLM Leaderboard - MuSR | 15.32 | Score | 82.6 |
| Open LLM Leaderboard - MMLU-Pro | 38.14 | Score | 82.2 |
| Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task | 92 | Accuracy (%) | 81.2 |
| Open Arabic LLM - Madinah QA Arabic Language (Grammar) | 54.25 | Accuracy (%) | 79 |
| Open Arabic LLM - Aratrust Privacy | 94.74 | Accuracy (%) | 78.3 |
| Open Arabic LLM - Arabic MMLU Math (Primary School) | 71.15 | Accuracy (%) | 78.1 |
| Open Arabic LLM - Madinah QA Average | 62.34 | Accuracy (%) | 77.8 |
| Open LLM Leaderboard - BBH | 37.02 | Score | 76.5 |
Interactive version: theaggregate.ai/model?slug=t-e-8-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.