rombos_Replete-Coder-Instruct-8B-Merged: benchmark results

Provider: Other. Released 2024-10-06. Access: Open.

Unified ELO 1436 ± 1, rank #1010 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard44.97Average Score (%)90.7
Open LLM Leaderboard - IFEval53.88Score64.6
Open Chinese LLM - GSM8K47.92Accuracy (%)60.4
Open Chinese LLM - WinoGrande63.69Accuracy (%)59.9
Open Chinese LLM - C-Eval Semantic68.99Accuracy (%)47.9
Open LLM Leaderboard - MATH Level 57.78Score40.1
Open Chinese LLM - CMMLU51.72Accuracy (%)39.6
Open Chinese LLM Leaderboard54.54Average Score (%)33.5
Open LLM Leaderboard - BBH21.94Score32.7
Open Chinese LLM - TruthfulQA MC51.42Accuracy (%)27.9
Open LLM Leaderboard - GPQA2.57Score23.9
Open Chinese LLM - ARC Challenge46.16Accuracy (%)20.5

Interactive version: theaggregate.ai/model?slug=rombos-replete-coder-instruct-8b-merged · How It Works · Data refreshed daily, snapshot 2026-09-05.