Automatic speech recognition in cocktail-party situations: a specific training for separated speech.

Amparo Marti1, Maximo Cobos, Jose J Lopez

  • 1Institute of Telecommunications and Multimedia Applications, Universitat Politècnica de València, 46022, Valencia, Spain. ammargue@iteam.upv.es

Summary

This study introduces a novel training method to enhance automatic speech recognition (ASR) accuracy in noisy environments. Combining source separation with specialized training significantly improves word recognition for simultaneous speech.