Tess-2.0-Llama-3-8B: benchmark results

Provider: Other. Released 2024-05-05. Access: Open.

Unified ELO 1427 ± 1, rank #1042 of 1392 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard39.63Average Score (%)69.5
Open Chinese LLM - WinoGrande63.06Accuracy (%)52.5
Open Chinese LLM - CMMLU52.83Accuracy (%)43.9
Open Chinese LLM - HellaSwag57.89Accuracy (%)35.6
Open Chinese LLM - C-Eval Semantic64.06Accuracy (%)35.3
Open Chinese LLM - GSM8K36.47Accuracy (%)32.9
Open Chinese LLM - TruthfulQA MC51.8Accuracy (%)32.3
Open Chinese LLM Leaderboard53.32Average Score (%)30.3
Open Chinese LLM - ARC Challenge47.1Accuracy (%)26.3

Interactive version: theaggregate.ai/model?slug=tess-2-0-llama-3-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.