What Counts as an Error? Dual-Reference Benchmarking for Atypical ASR
arXiv:2606.31112v1 Announce Type: new Abstract: ASR systems have been often reported to underperform on atypical speech. An often conflated compounding factor is the existence of two valid transcription references: verbatim (actual produced speech, including repetitions/prolongations) and intended (the canonical form of the text with disfluencies removed) in atypical speech recognition depending on context and use-case. Most ASR evaluations conflate this duality into a single ground truth and re...
arXiv cs.CL
·Hawau Olamide Toyin, Srinivasan Umesh, Hanan Aldarmaki
·
// relacionados
Leia também
Blog
Vazamento sugere que o gerador de música por IA Suno raspou o YouTube em busca de dados de treinamento
Blog
O primeiro hardware da marca OpenAI é... um teclado que acende?
Blog
Spotify aposta que assinantes Premium querem conversar com seu reprodutor de música
Blog