Ornith-1.5-9B: benchmark results
Provider: Ornith. Released 2026-08-19. Access: Open.
Unified ELO 1552 ± 1, rank #959 of 3078 rated models, from 33 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Nejumi 4 - GLP - Logical Reasoning | 94.5 | Score (%) | 93 |
| Nejumi 4 - ALT - Toxicity | 83.29 | Score (%) | 71.1 |
| Nejumi 4 - ALT - Truthfulness | 78.81 | Score (%) | 66.4 |
| Nejumi 4 - GLP - Expression | 97.5 | Score (%) | 66.4 |
| Nejumi 4 - ALT - Bias | 88.1 | Score (%) | 59.4 |
| Nejumi 4 - MT-Bench (Japanese) | 95.38 | Score (%) | 56.6 |
| Nejumi 4 - GLP - Reasoning | 74.11 | Score (%) | 55.5 |
| Nejumi 4 - GLP - Abstract Reasoning | 41 | Score (%) | 54.7 |
| Nejumi 4 - GLP - Applied Language | 87.42 | Score (%) | 33.6 |
| Nejumi 4 - GLP - Coding | 55.57 | Score (%) | 32 |
| Nejumi 4 - SWE-Bench (Japanese) | 35 | Score (%) | 32 |
| Nejumi 4 - GLP - Information Retrieval | 76.41 | Score (%) | 30.5 |
Interactive version: theaggregate.ai/model?slug=ornith-1-5-9b · How It Works · Data refreshed daily, snapshot 2026-09-19.