neural-chat-7B-v3-2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1479 ± 19, rank #1468 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR48.95Score96.8
Open LLM Leaderboard v1 - ARC Challenge67.49Normalized accuracy (%) (25-shot)77
Open LLM Leaderboard v1 - TruthfulQA MC259.68MC2 (%) (0-shot)74.2
Open LLM Leaderboard v1 - WinoGrande79.95Accuracy (%) (5-shot)71.7
Open LLM Leaderboard v1 - GSM8K55.12Accuracy (%) (5-shot)66.8
Open LLM Leaderboard v1 - HellaSwag83.92Normalized accuracy (%) (10-shot)62.4
Open LLM Leaderboard v1 - MMLU63.55Accuracy (%) (5-shot)61.5
Open LLM Leaderboard - IFEval49.88Score58.8
Open LLM Leaderboard - BBH50.32Score49.6
Open LLM Leaderboard - GPQA29.03Score45
Open LLM Leaderboard - MMLU-Pro26.67Score28.2
Open LLM Leaderboard - MATH Level 54.76Score26.9

Interactive version: theaggregate.ai/model?slug=neural-chat-7b-v3-2 · How It Works · Data refreshed daily, snapshot 2026-09-23.