GeM2-Llamion-14B-LongChat — benchmark results

Provider: Other. Released 2024-05-29. Access: Open.

Unified ELO 1390 ± 13, rank #1270 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard526.33Average Score (%)89.7
Open Chinese LLM - WinoGrande63.38Accuracy (%)55.8
Open Chinese LLM - CMMLU53.51Accuracy (%)51
Open Chinese LLM - HellaSwag60.08Accuracy (%)49.7
Open Chinese LLM - C-Eval Semantic65.04Accuracy (%)38.9
Open Chinese LLM - ARC Challenge49.15Accuracy (%)37.7
Open Chinese LLM - TruthfulQA MC51.76Accuracy (%)31.8
Open Chinese LLM Leaderboard53.03Average Score (%)28.9
Open Chinese LLM - GSM8K28.28Accuracy (%)21.1

Interactive version: theaggregate.ai/model?slug=gem2-llamion-14b-longchat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.