neural-chat-7B-v3-1: benchmark results

Provider: Other. Released 2023-11-14. Access: Open.

Unified ELO 1440 ± 1, rank #989 of 1392 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR22.24Score97.7
Open CoT - LogiQA6.07CoT Gain (%)76.3
Open CoT - LSAT Analytical Reasoning5.22CoT Gain (%)68.3
Open LLM Leaderboard - IFEval46.87Score53.6
Open Korean LLM Leaderboard35.82Average Score (%)50.7
Open LLM Leaderboard - BBH29.74Score50.7
Open LLM Leaderboard - GPQA5.37Score45
Open CoT Leaderboard4.87Average CoT Gain (%)29.8
Open LLM Leaderboard - MMLU-Pro18.64Score28.3
Open CoT - LSAT Reading Comprehension6.32CoT Gain (%)26
Open CoT - LogiQA 22.42CoT Gain (%)21.8
Open CoT - LSAT Logical Reasoning4.31CoT Gain (%)21.4

Interactive version: theaggregate.ai/model?slug=neural-chat-7b-v3-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.