ChimeraLlama-3-8B-v2 — benchmark results

Provider: Other. Released 2024-04-22. Access: Open.

Unified ELO 1394 ± 13, rank #1256 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K50.72Accuracy (%)69.3
Open Chinese LLM - TruthfulQA MC54.76Accuracy (%)58.2
Open Chinese LLM - C-Eval Semantic71.46Accuracy (%)57.3
Open Chinese LLM Leaderboard56.89Average Score (%)56.1
Open LLM Leaderboard - MMLU-Pro28.54Score53.7
Open Chinese LLM - CMMLU54.16Accuracy (%)53.6
Open LLM Leaderboard - IFEval44.69Score48.8
Open LLM Leaderboard - BBH28.48Score46.7
Open LLM Leaderboard - MATH Level 59.06Score44.4
Open LLM Leaderboard - GPQA4.7Score40.2
Open Chinese LLM - ARC Challenge49.57Accuracy (%)39.6
Open Chinese LLM - WinoGrande62.19Accuracy (%)37.8

Interactive version: theaggregate.ai/model?slug=chimerallama-3-8b-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.