Tess-M-v1.3: benchmark results

Provider: Other. Access: Open.

Unified ELO 1516 ± 33, rank #1000 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI80.55Macro F1 (%)90.3
Open Portuguese LLM - OAB Exams55.58Accuracy (%)88.3
Open Chinese LLM - C-Eval Semantic87.84Accuracy (%)86.4
Open Portuguese LLM - BLUEX64.81Accuracy (%)85.7
Open Portuguese LLM - ENEM72.36Accuracy (%)82.9
Open Chinese LLM - CMMLU68.59Accuracy (%)81
Open Chinese LLM - WinoGrande67.01Accuracy (%)80.9
Open Chinese LLM Leaderboard60.88Average Score (%)72.4
Open Portuguese LLM - ASSIN2 RTE91.46Macro F1 (%)67.2
Open Chinese LLM - ARC Challenge53.5Accuracy (%)56.7
Open Chinese LLM - HellaSwag60.42Accuracy (%)51.6
Open Chinese LLM - TruthfulQA MC52.21Accuracy (%)35.6

Interactive version: theaggregate.ai/model?slug=tess-m-v1-3 · How It Works · Data refreshed daily, snapshot 2026-09-19.