LongChat-7B-v1.5-32k: benchmark results

Provider: Other. Released 2023-08-01. Access: Open.

Unified ELO 1336 ± 10, rank #2558 of 2928 rated models, from 74 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Abstract Algebra34Accuracy (%)82.1
MMLU-by-task - High School Mathematics30.74Accuracy (%)81.5
MMLU-by-task - College Mathematics35Accuracy (%)75.2
MMLU-by-task - Elementary Mathematics31.75Accuracy (%)65.6
MMLU-by-task - Machine Learning34.82Accuracy (%)60.6
MMLU-by-task - High School European History63.03Accuracy (%)56.4
MMLU-by-task - High School Statistics39.81Accuracy (%)54.6
MMLU-by-task - TruthfulQA MC129.38Accuracy (%)54.2
MMLU-by-task - High School US History62.25Accuracy (%)54
MMLU-by-task - High School Geography57.58Accuracy (%)52.8
MMLU-by-task - Clinical Knowledge48.3Accuracy (%)51.3
MMLU-by-task - High School Chemistry33.99Accuracy (%)50.8

Interactive version: theaggregate.ai/model?slug=longchat-7b-v1-5-32k · How It Works · Data refreshed daily, snapshot 2026-09-23.