Sonar Deep Research: benchmark results

Provider: Perplexity. Access: API.

Unified ELO 1790 ± 32, rank #100 of 1605 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LitReviewBench - Research Suggestions1322.7Expert-preference rating (Elo scale, Bradley-Terry aggregati100
LitReviewBench1285.9Expert-preference rating (Elo scale, Bradley-Terry aggregati87.5
LitReviewBench - Claim Support1106.3Expert-preference rating (Elo scale, Bradley-Terry aggregati87.5
LitReviewBench - Literature Coverage1175.9Expert-preference rating (Elo scale, Bradley-Terry aggregati87.5
LitReviewBench - Paper Structure1262.1Expert-preference rating (Elo scale, Bradley-Terry aggregati87.5
Tinybird AI SQL Benchmark - Success Rate100Questions answered with a valid query within 3 retries (%)72.3
Tinybird AI SQL Benchmark - Exactness49.82Result exactness vs human reference queries (0-100)57.7
Mr Dre - Content Feedback Incorporation Rate92.6Incorporation rate (%; turn-2 revision after content feedbac50
OneMillion-Bench13.5Pass Rate (%)45.6
Software Engineering Arena - Model Arena998Elo Rating38.6
LM Market Cap LMC Score40LMC Score (0-100)28.3
Mr Dre - Content Feedback Break Rate34.3Break rate (%; share of checklist criteria covered in the tu25

Interactive version: theaggregate.ai/model?slug=sonar-deep-research · How It Works · Data refreshed daily, snapshot 2026-09-26.