Ornith-1.5-35B-A3B: benchmark results
Provider: Ornith. Released 2026-08-19. Access: Open.
Unified ELO 1612 ± 1, rank #556 of 3078 rated models, from 34 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Nejumi 4 - GLP - Logical Reasoning | 94 | Score (%) | 88.7 |
| Nejumi 4 - GLP - Expression | 98.33 | Score (%) | 85.2 |
| Nejumi 4 - MT-Bench (Japanese) | 97 | Score (%) | 81.2 |
| Nejumi 4 - ALT - Toxicity | 83.53 | Score (%) | 76.6 |
| Nejumi 4 - GLP - Semantic Analysis | 83.6 | Score (%) | 71.9 |
| Nejumi 4 - ALT - Truthfulness | 79.74 | Score (%) | 71.1 |
| Nejumi 4 - ALT - Bias | 89.47 | Score (%) | 69.9 |
| Nejumi 4 - GLP - Reasoning | 79.22 | Score (%) | 67.2 |
| Nejumi 4 - GLP - Abstract Reasoning | 52 | Score (%) | 66.4 |
| Nejumi 4 - GLP - Applied Language | 88.78 | Score (%) | 63.3 |
| Nejumi 4 - GLP - Coding | 62.42 | Score (%) | 61.7 |
| Humanity's Last Exam (Self-Reported, No Tools) | 25.6 | Accuracy (%) | 57.4 |
Interactive version: theaggregate.ai/model?slug=ornith-1-5-35b-a3b · How It Works · Data refreshed daily, snapshot 2026-09-19.