Tess-2.0-Llama-3-8B — benchmark results

Provider: Other. Released 2024-05-05. Access: Open.

Unified ELO 1373 ± 9, rank #1332 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard260.77Average Score (%)64.3
Open Chinese LLM - WinoGrande63.06Accuracy (%)52.5
Open Chinese LLM - CMMLU52.83Accuracy (%)43.9
Open Chinese LLM - HellaSwag57.89Accuracy (%)35.6
Open Chinese LLM - C-Eval Semantic64.06Accuracy (%)35.3
Open Chinese LLM - GSM8K36.47Accuracy (%)32.9
Open Chinese LLM - TruthfulQA MC51.8Accuracy (%)32.3
Open Chinese LLM Leaderboard53.32Average Score (%)30.3
Open Chinese LLM - ARC Challenge47.1Accuracy (%)26.3

Interactive version: theaggregate.ai/model?slug=tess-2-0-llama-3-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.