GeM2-Llamion-14B-Chat: benchmark results

Provider: Other. Released 2024-05-13. Access: Open.

Unified ELO 1436 ± 1, rank #1012 of 1392 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard41.16Average Score (%)78.7
Open Chinese LLM - HellaSwag62.61Accuracy (%)68.5
Open Chinese LLM - CMMLU57.25Accuracy (%)63.5
Open Chinese LLM - C-Eval Semantic73.23Accuracy (%)62
Open Chinese LLM - ARC Challenge51.62Accuracy (%)46.3
Open Chinese LLM - WinoGrande62.35Accuracy (%)41.8
Open Chinese LLM Leaderboard55.5Average Score (%)40.1
Open Chinese LLM - GSM8K32.22Accuracy (%)27.3
Open Chinese LLM - TruthfulQA MC49.19Accuracy (%)14.8

Interactive version: theaggregate.ai/model?slug=gem2-llamion-14b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.