L-MChat-Small — benchmark results

Provider: Other. Released 2024-04-11. Access: Open.

Unified ELO 1257 ± 28, rank #1605 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR9.27Score44.8
Open LLM Leaderboard - BBH26.86Score42.2
Open LLM Leaderboard - IFEval32.87Score30.8
Open LLM Leaderboard - MMLU-Pro16.27Score25.2
Open LLM Leaderboard - GPQA2.35Score22.1
Open LLM Leaderboard - MATH Level 53.78Score21.8
Open Chinese LLM - TruthfulQA MC49.57Accuracy (%)16.5
Open Chinese LLM - GSM8K7.66Accuracy (%)7.4
Open Chinese LLM - C-Eval Semantic33.88Accuracy (%)3.9
Open Chinese LLM - CMMLU33.06Accuracy (%)3.3
Open Chinese LLM - WinoGrande51.7Accuracy (%)2.7
Open Chinese LLM Leaderboard33.68Average Score (%)2.4

Interactive version: theaggregate.ai/model?slug=l-mchat-small · How the rankings work · Data refreshed daily, snapshot 2026-07-22.