对于杂的环境而言,耳鼻喉语音增强使用帕雷托否定门式LSTM
Rytis Maskeliūnas1, Robertas Damaševičius1, Audrius Kulikajevas1
1Centre of Real Time Computer Systems, Kaunas University of Technology, Kaunas, Lithuania.
Journal of voice : official journal of the Voice Foundation
|August 6, 2024
概括
本研究介绍了一种先进的语音增强系统,用于耳鼻喉发言的个体,显著减少背景噪音和提高语音清晰度. 这种新方法提高了使用气管食道假肢的喉切除术患者的可理解性.
科学领域:
- 生物医学工程 生物医学工程
- 语言病理学 语音病理学
- 人工智能的人工智能
背景情况:
- 喉损失需要使用其他语音方法,影响沟通和生活质量.
- 喉语音增强旨在提高喉切除术患者的可理解性和减少噪音.
- 气管食道假肢 (TEP) 语音是一种常见的康复方法.
研究的目的:
- 开发和评估一个先进的耳鼻喉语音增强系统.
- 为了提高信号质量和减少气管食道发言中的背景噪音.
- 为了提高语音可理解性和保存关键的语音信息.
主要方法:
- 在气管食道语音数据上训练了一个巴雷托优化的长期短期记忆 (LSTM) 网.
- 使用了23名立陶宛男性TEP的语音样本.
- 开发了一个系统来区分语音,噪音和文物.
主要成果:
- 与其他方法相比,平均信号与噪声比率降低了25%.
- 从40%降低到10%显著减少了无声.
- 保持了表达和平均表达证据的稳定比例.
结论:
- 开发的系统通过减少噪音和文物,有效地增强了耳鼻喉语音.
- 这种方法保留了基本的语音组件,提高了整体的语音清晰度.
- 这项技术为喉切除术患者的沟通康复提供了有前途的进展.


