GeM2-Llamion-14B-Chat — benchmark results

Provider: Other. Released 2024-05-13. Access: Open.

Unified ELO 1385 ± 10, rank #1289 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - HellaSwag62.61Accuracy (%)68.5
Open Korean LLM Leaderboard292.1Average Score (%)66.3
Open Chinese LLM - CMMLU57.25Accuracy (%)63.5
Open Chinese LLM - C-Eval Semantic73.23Accuracy (%)62
Open Chinese LLM - ARC Challenge51.62Accuracy (%)46.3
Open Chinese LLM - WinoGrande62.35Accuracy (%)41.8
Open Chinese LLM Leaderboard55.5Average Score (%)40.1
Open Chinese LLM - GSM8K32.22Accuracy (%)27.3
Open Chinese LLM - TruthfulQA MC49.19Accuracy (%)14.8

Interactive version: theaggregate.ai/model?slug=gem2-llamion-14b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.