neural-chat-7B-v3: benchmark results

Provider: Other. Access: Open.

Unified ELO 1455 ± 21, rank #1681 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR50.55Score98.9
Open LLM Leaderboard v1 - ARC Challenge67.15Normalized accuracy (%) (25-shot)75.9
Open LLM Leaderboard v1 - TruthfulQA MC258.77MC2 (%) (0-shot)72.6
Open LLM Leaderboard v1 - WinoGrande78.06Accuracy (%) (5-shot)60.4
Open LLM Leaderboard v1 - HellaSwag83.29Normalized accuracy (%) (10-shot)57.6
Open LLM Leaderboard v1 - MMLU62.26Accuracy (%) (5-shot)54.8
Open LLM Leaderboard - BBH50.48Score50.4
Open LLM Leaderboard - GPQA29.19Score46.9
Open LLM Leaderboard - MMLU-Pro26.99Score28.7
Open LLM Leaderboard - IFEval27.78Score24.9
Open LLM Leaderboard - MATH Level 52.95Score18.6
Open LLM Leaderboard v1 - GSM8K1.21Accuracy (%) (5-shot)16

Interactive version: theaggregate.ai/model?slug=neural-chat-7b-v3 · How It Works · Data refreshed daily, snapshot 2026-09-23.