Yi-1.5-9B Chat — benchmark results

01.AI's Apache-2.0 9B chat model from the Yi-1.5 series (May 2024), continually pretrained on 500B extra tokens and tuned on 3M samples. Provider: 01.AI. Released 2024-05-13. Access: Open.

Unified ELO 1416 ± 15, rank #1148 of 1776 rated models, from 62 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LatamBoard - Spanish MGSM18.8Score (%)93.9
Mobile-MMLU72.7Overall Accuracy (%)90.5
LA Leaderboard - Spanish Law Exams39.5Accuracy (%)88.2
Open Chinese LLM - GSM8K64.22Accuracy (%)88.1
LatamBoard - Spanish Escola71.04Score (%)87.9
LatamBoard - Spanish PAWS63Score (%)86.4
LatamBoard - Spanish TeleIA71.43Score (%)86.4
Open CoT - LogiQA7.51CoT Gain (%)85.9
Open LLM Leaderboard - GPQA11.3Score82.3
LatamBoard - FaQuAD NLI76.18Score (%)78.8
Open Chinese LLM Leaderboard64.07Average Score (%)78
Open CoT - LSAT Analytical Reasoning6.09CoT Gain (%)76.7

Interactive version: theaggregate.ai/model?slug=yi-1-5-9b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.