OpenChat-3.5-7B-Solar: benchmark results

Provider: Other. Access: Open.

Unified ELO 1474 ± 19, rank #1522 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ASSIN2 RTE92.77Macro F1 (%)83.4
Open Portuguese LLM - FaQuAD NLI77.78Macro F1 (%)81
Open LLM Leaderboard v1 - GSM8K62.55Accuracy (%) (5-shot)75.9
Open LLM Leaderboard v1 - WinoGrande79.48Accuracy (%) (5-shot)69.4
Open LLM Leaderboard v1 - HellaSwag84.19Normalized accuracy (%) (10-shot)64.4
Open LLM Leaderboard v1 - MMLU63.94Accuracy (%) (5-shot)64.3
Open Portuguese LLM - BLUEX54.66Accuracy (%)60.9
Open LLM Leaderboard v1 - ARC Challenge62.97Normalized accuracy (%) (25-shot)60.6
Open Portuguese LLM - ENEM64.52Accuracy (%)58.9
Open Portuguese LLM - OAB Exams42.19Accuracy (%)50.7
YALL Nous Leaderboard52.2Average45.6
Open LLM Leaderboard v1 - TruthfulQA MC245.65MC2 (%) (0-shot)31.6

Interactive version: theaggregate.ai/model?slug=openchat-3-5-7b-solar · How It Works · Data refreshed daily, snapshot 2026-09-23.