A.X-4.0-Light: benchmark results
Provider: SK Telecom. Access: Open.
Unified ELO 1525 ± 29, rank #957 of 2653 rated models, from 37 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Horangi 4 - Korean Hate Speech | 60 | Accuracy (%) | 47.6 |
| K-MetBench | 55.7 | Accuracy (self-reported) | 44.8 |
| Horangi 4 - KoBBQ | 81 | Accuracy (%) | 38.9 |
| Horangi 4 - Ko-HalluLens (Nonexistent Entities) | 68 | Refusal rate (%) | 37.5 |
| PetQA-Bench - Text Helpfulness | 4.21 | Rubric Score (1-5) | 35.3 |
| Horangi 4 - HAE-RAE Bench (without Reading Comprehension) | 80.81 | Accuracy (%) | 32.2 |
| PetQA-Bench - Text Factuality | 50.2 | Factuality (%) | 29.4 |
| Horangi 4 - KorQuAD 1.0 | 73.88 | F1 (x100) | 26.9 |
| Horangi 4 - GLP - General Knowledge | 72.4 | Score (%) | 24 |
| Horangi 4 - HAE-RAE Bench (Reading Comprehension) | 79 | Accuracy (%) | 22.6 |
| Horangi 4 - IFEval-Ko | 76.92 | Instruction-following accuracy (%) | 22.1 |
| Horangi 4 - Ko-MT-Bench | 83.5 | Judge rating (1-10, x10) | 22.1 |
Interactive version: theaggregate.ai/model?slug=a-x-4-0-light · How It Works · Data refreshed daily, snapshot 2026-09-21.