rombos_Replete-Coder-Llama3-8B — benchmark results

Provider: Other. Released 2024-10-06. Access: Open.

Unified ELO 1356 ± 12, rank #1394 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard373.09Average Score (%)73.7
Open Chinese LLM - WinoGrande64.33Accuracy (%)66.3
Open LLM Leaderboard - IFEval47.14Score54.2
Open LLM Leaderboard - MuSR7.71Score35.9
Open Chinese LLM - CMMLU49.77Accuracy (%)32.6
Open Chinese LLM - GSM8K32.68Accuracy (%)27.9
Open Chinese LLM - HellaSwag54.65Accuracy (%)22.8
Open LLM Leaderboard - MATH Level 53.93Score22.6
Open Chinese LLM - TruthfulQA MC50.45Accuracy (%)21.4
Open LLM Leaderboard - GPQA2.24Score21.2
Open Chinese LLM Leaderboard50.69Average Score (%)21.1
Open Chinese LLM - C-Eval Semantic59.63Accuracy (%)20.5

Interactive version: theaggregate.ai/model?slug=rombos-replete-coder-llama3-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.