AudioBench - People's Speech WER — leaderboard

Metric: WER (%) (lower is better). Source: github.com. 9 models tracked.

Top models

#ModelScore
1cascade_whisper_large_v3_llama_3_8b_instruct14.54
2whisper_large_v314.6
3cascade_whisper_large_v2_gemma2_9b_cpt_sea_lionv3_instruct20.14
4MERaLiON-AudioLLM-Whisper-SEA-LION21.05
5Qwen2-Audio-7B-Instruct21.65
6SALMONN_7B23.7
7Qwen-Audio-Chat31.42
8seallms_audio_7b36.98
9WavLLM_fairseq37.92

Interactive version: theaggregate.ai/benchmark?slug=audiobench-people-s-speech-wer · How the rankings work · Data refreshed daily, snapshot 2026-07-22.