AppTek Call-Center Dialogues (Fixed 30s Chunks): leaderboard
Metric: Word error rate (%, averaged over the 14 accents) on AppTek Call-Center Dialogues (128.6 hours of spontaneous role-played English call-center conversations, 14 accents), default inference settings, scored per session after Open ASR Leaderboard text normalization, audio segmented with fixed 30-second chunks; lower is better. Source: arxiv.org. Saturation forecast: Around December 2026. 12 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Phi-4 Multimodal Instruct | 11.9 |
| 2 | Whisper Large-v3 | 42.9 |
Interactive version: theaggregate.ai/benchmark?slug=apptek-call-center-dialogues-fixed-30s-chunks · How It Works · Data refreshed daily, snapshot 2026-10-07.