Nova 2.0 Lite (Non-reasoning): benchmark results
Provider: Amazon. Released 2025-12-02. Access: API.
Unified ELO 1511 ± 1, rank #918 of 2033 rated models, from 492 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Ko-AgentBench - L1 Single Tool Call | 79.55 | Argument Accuracy (%) | 100 |
| Evals for Every Language - Chiga (cgg) | 100 | Average Score (%) | 99.2 |
| Evals for Every Language - Western Frisian (fy) | 100 | Average Score (%) | 98.5 |
| Evals for Every Language - Breton (br) | 100 | Average Score (%) | 97 |
| AGC-Bench - grapheval_ai_researcher | 1.11 | Dataset z-score | 96.3 |
| Nejumi 4 - Toxicity - Violation Categories | 57.14 | Criteria met (%) | 95.2 |
| AGC-Bench - hypobench | 0.42 | Dataset z-score | 93.9 |
| Evals for Every Language - Betawi (bew) | 100 | Average Score (%) | 91.7 |
| Evals for Every Language - Divehi (dv) | 100 | Average Score (%) | 91.7 |
| Vectara Hallucination Leaderboard | 94.9 | Factual Consistency Rate (%) | 90.7 |
| Evals for Every Language - Corsican (co) | 100 | Average Score (%) | 89.6 |
| AGC-Bench - mops | 1.05 | Dataset z-score | 89 |
Interactive version: theaggregate.ai/model?slug=nova-2-0-lite-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-28.