rombos_Replete-Coder-Instruct-8B-Merged — benchmark results

Provider: Other. Released 2024-10-06. Access: Open.

Unified ELO 1378 ± 20, rank #1319 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard515.18Average Score (%)88.9
Open LLM Leaderboard - IFEval53.88Score64.6
Open Chinese LLM - GSM8K47.92Accuracy (%)60.4
Open Chinese LLM - WinoGrande63.69Accuracy (%)59.9
Open Chinese LLM - C-Eval Semantic68.99Accuracy (%)47.9
Open LLM Leaderboard - MATH Level 57.78Score40.1
Open Chinese LLM - CMMLU51.72Accuracy (%)39.6
Open Chinese LLM Leaderboard54.54Average Score (%)33.5
Open LLM Leaderboard - BBH21.94Score32.6
Open Chinese LLM - TruthfulQA MC51.42Accuracy (%)27.9
Open LLM Leaderboard - GPQA2.57Score23.9
Open Chinese LLM - ARC Challenge46.16Accuracy (%)20.5

Interactive version: theaggregate.ai/model?slug=rombos-replete-coder-instruct-8b-merged · How the rankings work · Data refreshed daily, snapshot 2026-07-22.