Ornith-1.5-9B: benchmark results

Provider: Ornith. Released 2026-08-19. Access: Open.

Unified ELO 1552 ± 1, rank #959 of 3078 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - GLP - Logical Reasoning94.5Score (%)93
Nejumi 4 - ALT - Toxicity83.29Score (%)71.1
Nejumi 4 - ALT - Truthfulness78.81Score (%)66.4
Nejumi 4 - GLP - Expression97.5Score (%)66.4
Nejumi 4 - ALT - Bias88.1Score (%)59.4
Nejumi 4 - MT-Bench (Japanese)95.38Score (%)56.6
Nejumi 4 - GLP - Reasoning74.11Score (%)55.5
Nejumi 4 - GLP - Abstract Reasoning41Score (%)54.7
Nejumi 4 - GLP - Applied Language87.42Score (%)33.6
Nejumi 4 - GLP - Coding55.57Score (%)32
Nejumi 4 - SWE-Bench (Japanese)35Score (%)32
Nejumi 4 - GLP - Information Retrieval76.41Score (%)30.5

Interactive version: theaggregate.ai/model?slug=ornith-1-5-9b · How It Works · Data refreshed daily, snapshot 2026-09-19.