Baichuan2-13B-Chat: benchmark results

Provider: Baichuan. Released 2023-09-06. Access: Open.

Unified ELO 1430 ± 17, rank #1659 of 2656 rated models, from 115 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenCompass Reasoning - Inductive - English (CompassBench 2404)32.3Score (%)73.3
SuperCLUE-Agent (October 2023) - Tool Use61.11Score72.2
SuperCLUE General (September 2023) - Open-Ended Questions (OPEN)52.45Score68.4
OpenCompass Language - Translation (CompassBench 2404)15.4Score (%)68.3
OpenCompass LLM - Reasoning - English (CompassBench 2404)29.4Score (%)66.7
SuperCLUE-Agent (October 2023) - Overall52.44Score66.7
SuperCLUE General (September 2023) - Overall58.03Score63.2
SuperCLUE-Agent (October 2023) - Long & Short-term Memory52.74Score61.1
OpenCompass Reasoning - Abductive - English (CompassBench 2404)66Score (%)58.6
OpenCompass Subjective - Knowledge (CompassBench 2404)28.5Score (%)58
OpenCompass Reasoning - Deductive - Chinese (CompassBench 2404)25.1Score (%)56.7
SuperCLUE-Agent (October 2023) - Task Planning40.48Score55.6

Interactive version: theaggregate.ai/model?slug=baichuan2-13b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.