ReflectionCoder-CL-34B: benchmark results

Provider: Other. Released 2024-05-28. Access: Open.

Unified ELO 1357 ± 1, rank #1255 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR10.4Score52.2
BigCodeBench37.7Pass@1 (%)47.2
Open LLM Leaderboard - IFEval40.08Score40
Open LLM Leaderboard - BBH14.26Score22.9
Open LLM Leaderboard - MATH Level 53.32Score20.2
Open Chinese LLM - GSM8K22.82Accuracy (%)15.6
Open Chinese LLM - TruthfulQA MC49.24Accuracy (%)15.1
Open LLM Leaderboard - MMLU-Pro4.71Score11.9
Open Chinese LLM - ARC Challenge41.55Accuracy (%)9.5
Open Chinese LLM - HellaSwag50.41Accuracy (%)8.3
Open Chinese LLM - WinoGrande57.3Accuracy (%)8.2
Open Chinese LLM Leaderboard43.12Average Score (%)7.4

Interactive version: theaggregate.ai/model?slug=reflectioncoder-cl-34b · How It Works · Data refreshed daily, snapshot 2026-09-05.