AA-Omniscience Hallucination Rate: leaderboard
Metric: Hallucination Rate (%). Source: artificialanalysis.ai. 527 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Command A+ | 14.16 |
| 2 | LFM2.5-2.6B | 16 |
| 3 | Grok 4.3 (Medium) | 16.94 |
| 4 | Qwen 3.8 27B (Non-reasoning) | 18.09 |
| 5 | MiniMax-M3 | 18.43 |
| 6 | Ling-3.0-flash-VL | 22.05 |
| 7 | Grok 4.20 0309 (Reasoning) | 22.4 |
| 8 | Grok 4.6 (Medium) | 24 |
| 9 | Grok 4.6 (xHigh) | 24.01 |
| 10 | Solar Pro 4 | 24.4 |
| 11 | MiMo-V2.5-Pro | 24.7 |
| 12 | Solar Open2 250B | 25.38 |
| 13 | Granite 4.2 30B | 25.58 |
| 14 | Qwen 3.7 Max | 25.63 |
| 15 | Claude Haiku 4.5 (Non-reasoning) | 25.71 |
Interactive version: theaggregate.ai/benchmark?slug=aa-omniscience-hallucination-rate · How It Works · Data refreshed daily, snapshot 2026-09-19.