rombos_Replete-Coder-Llama3-8B: benchmark results

Provider: Other. Released 2024-10-06. Access: Open.

Unified ELO 1402 ± 1, rank #1128 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard38.94Average Score (%)66.5
Open Chinese LLM - WinoGrande64.33Accuracy (%)66.3
Open LLM Leaderboard - IFEval47.14Score54.2
Open LLM Leaderboard - MuSR7.71Score35.9
Open Chinese LLM - CMMLU49.77Accuracy (%)32.6
Open Chinese LLM - GSM8K32.68Accuracy (%)27.9
Open Chinese LLM - HellaSwag54.65Accuracy (%)22.8
Open LLM Leaderboard - MATH Level 53.93Score22.6
Open Chinese LLM - TruthfulQA MC50.45Accuracy (%)21.4
Open LLM Leaderboard - GPQA2.24Score21.2
Open Chinese LLM Leaderboard50.69Average Score (%)21.1
Open Chinese LLM - C-Eval Semantic59.63Accuracy (%)20.5

Interactive version: theaggregate.ai/model?slug=rombos-replete-coder-llama3-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.