Target Selection Strategies for Demucs-Based Speech Enhancement
Tema
Aprendizaje automático (Machine learning)
Fecha de publicación
3-jul-2023
Editor
Applied sciences
Descripción física
Artículo académico que trata sobre la mejora del habla en línea (online speech enhancement) en escenarios con múltiples fuentes de voz, un desafío común en aplicaciones de audio en tiempo real como el reconocimiento automático del habla, la robótica, las prótesis auditivas, la telefonía móvil y la teleconferencia. El artículo presenta y evalúa dos enfoques para adaptar el modelo Demucs-Denoiser a entornos con múltiples voces, comparando su rendimiento y destacando sus fortalezas y limitaciones según el escenario acústico.