neural-chat-7B-v3-1 — benchmark results

Provider: Other. Released 2023-11-14. Access: Open.

Unified ELO 1347 ± 41, rank #1430 of 1776 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR22.24Score97.7
Open CoT - LogiQA6.07CoT Gain (%)76.3
Open CoT - LSAT Analytical Reasoning5.22CoT Gain (%)68.3
Open LLM Leaderboard - IFEval46.87Score53.6
Open LLM Leaderboard - BBH29.74Score50.7
Open LLM Leaderboard - GPQA5.37Score44.9
Open Korean LLM Leaderboard35.82Average Score (%)40
Open CoT Leaderboard4.87Average CoT Gain (%)29.8
Open LLM Leaderboard - MMLU-Pro18.64Score28.3
Open CoT - LSAT Reading Comprehension6.32CoT Gain (%)26
Open CoT - LogiQA 22.42CoT Gain (%)21.8
Open CoT - LSAT Logical Reasoning4.31CoT Gain (%)21.4

Interactive version: theaggregate.ai/model?slug=neural-chat-7b-v3-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.