deep-solar-v3.0: benchmark results

Provider: Other. Access: Open.

Unified ELO 1319 ± 19, rank #2395 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande62.67Accuracy (%)69.8
Open Korean LLM - Ko-GSM8K (flexible extract)20.7Exact match, flexible extract (%)52.9
Open Korean LLM - KorNAT-CKA24.57Normalized accuracy (%)52
Open Korean LLM - KorNAT-Harmless62.69Normalized accuracy (%)49
Open Korean LLM - KorNAT-Helpful44.95Normalized accuracy (%)33.4
Open Korean LLM - Ko-IFEval24.6Strict accuracy, prompt/instruction mean (%)30.5
Open Korean LLM - Ko-GPQA-Diamond20.2Normalized accuracy (%)13.9
Open Ko-LLM Leaderboard28.44Average (%)6.4
Open Korean LLM Leaderboard28.44Average Score (%)6.4
Open Korean LLM - Ko-EQ-Bench-25.87EQ-Bench score0.8

Interactive version: theaggregate.ai/model?slug=deep-solar-v3-0 · How It Works · Data refreshed daily, snapshot 2026-09-19.