AppTek Call-Center Dialogues (Proprietary Segmenter): leaderboard
Metric: Word error rate (%, averaged over the 14 accents) on AppTek Call-Center Dialogues (128.6 hours of spontaneous role-played English call-center conversations, 14 accents), default inference settings, scored per session after Open ASR Leaderboard text normalization, audio segmented with the corpus owner's proprietary segmenter; lower is better. Source: arxiv.org. Saturation forecast: Around December 2026. 12 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Phi-4 Multimodal Instruct | 9.8 |
| 2 | Whisper Large-v3 | 18.9 |
Interactive version: theaggregate.ai/benchmark?slug=apptek-call-center-dialogues-proprietary-segmenter · How It Works · Data refreshed daily, snapshot 2026-10-07.