Xwin-LM-7B-V0.2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1315 ± 17, rank #2403 of 2656 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Harmless64.43Normalized accuracy (%)74.3
Open Korean LLM - Ko-GPQA-Diamond23.23Normalized accuracy (%)48.1
Open Portuguese LLM - FaQuAD NLI56.75Macro F1 (%)39.5
Open Korean LLM - KorNAT-Helpful44.8Normalized accuracy (%)32.8
Open Portuguese LLM - OAB Exams34.53Accuracy (%)31.3
Open Portuguese LLM - ENEM42.9Accuracy (%)31.2
Open Portuguese LLM - BLUEX37.41Accuracy (%)30.8
Open Korean LLM - Ko-Winogrande56.27Accuracy (%)25.3
pfgen-bench - QA Mode - Fluency0.47Fluency Score24.8
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
pfgen-bench - QA Mode - Score0.37pfgen Score (mean of three)23
pfgen-bench - QA Mode - Helpfulness0.06Helpfulness Score22.4

Interactive version: theaggregate.ai/model?slug=xwin-lm-7b-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-19.