Inkling Small: benchmark results

Provider: Thinking Machines. Released 2026-07-30. Access: Open.

Unified ELO 1836 ± 12, rank #105 of 2656 rated models, from 262 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - GLP - Logical Reasoning98.5Score (%)100
Nejumi 4 - MT-Bench (Japanese)98.75Score (%)98.8
AA Omniscience - Software Engineering (SWE) - Rust78Accuracy (%)97.6
AA-AnalystAgent - Pass@K80Pass@K (%)96.9
Vals AI CorpFin v269.62Accuracy (%)96.2
Nejumi 4 - ALT - Toxicity86.39Score (%)95.3
AA Omniscience - Software Engineering (SWE) - C69Accuracy (%)95.2
EnterpriseOps-Gym-AA - Drive62.86Task Success (%)94.7
AA Omniscience - Software Engineering (SWE) - Kotlin44Accuracy (%)94.5
SEAL - AudioMultiChallenge - Text Output54.87Score94.1
AA Omniscience - Software Engineering (SWE) - JavaScript52.73Accuracy (%)93.5
AA Omniscience - Software Engineering (SWE) - TypeScript48.89Accuracy (%)93.3

Interactive version: theaggregate.ai/model?slug=inkling-small · How It Works · Data refreshed daily, snapshot 2026-09-19.