Ornith-1.5-35B-A3B: benchmark results

Provider: Ornith. Released 2026-08-19. Access: Open.

Unified ELO 1612 ± 1, rank #556 of 3078 rated models, from 34 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - GLP - Logical Reasoning94Score (%)88.7
Nejumi 4 - GLP - Expression98.33Score (%)85.2
Nejumi 4 - MT-Bench (Japanese)97Score (%)81.2
Nejumi 4 - ALT - Toxicity83.53Score (%)76.6
Nejumi 4 - GLP - Semantic Analysis83.6Score (%)71.9
Nejumi 4 - ALT - Truthfulness79.74Score (%)71.1
Nejumi 4 - ALT - Bias89.47Score (%)69.9
Nejumi 4 - GLP - Reasoning79.22Score (%)67.2
Nejumi 4 - GLP - Abstract Reasoning52Score (%)66.4
Nejumi 4 - GLP - Applied Language88.78Score (%)63.3
Nejumi 4 - GLP - Coding62.42Score (%)61.7
Humanity's Last Exam (Self-Reported, No Tools)25.6Accuracy (%)57.4

Interactive version: theaggregate.ai/model?slug=ornith-1-5-35b-a3b · How It Works · Data refreshed daily, snapshot 2026-09-19.