autotrain-llama3-70B-orpo-v1 — benchmark results

Provider: Other. Access: Open.

Unified ELO 1369 ± 55, rank #1350 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - CMMLU72.42Accuracy (%)96.4
Open Chinese LLM - GSM8K68.84Accuracy (%)93.2
Open Chinese LLM Leaderboard66.82Average Score (%)86.1
Open Chinese LLM - C-Eval Semantic87.33Accuracy (%)84.3
Open Chinese LLM - ARC Challenge58.96Accuracy (%)82.2
Open LLM Leaderboard - BBH41.57Score80.8
Open Chinese LLM - HellaSwag63.66Accuracy (%)73.9
Open Chinese LLM - TruthfulQA MC54.11Accuracy (%)54.9
Open LLM Leaderboard - IFEval42.33Score43.7
Open Chinese LLM - WinoGrande62.43Accuracy (%)43.3
Open LLM Leaderboard - MuSR2.57Score11.7
Open LLM Leaderboard - MATH Level 51.06Score7.6

Interactive version: theaggregate.ai/model?slug=autotrain-llama3-70b-orpo-v1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.