:

Xiaodong Zhu1, Junqi Yang1, Yuhong Yang1

  • 1National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University, China; Hubei Key Laboratory of Multimedia and Network Communication Engineering, Wuhan University, China.

概括

本研究介绍了一种轻量级的Mamba状态空间模型 (SSM) 框架,用于实时语音增强. 新的多光谱扫描技术显著提高了语音质量和清晰度,同时保持了高效率.