A Study of Speech Recognition for Kazakh Based on Unsupervised Pre-Training

Weijing Meng1,2, Nurmemet Yolwas1,2

  • 1Xinjiang Multilingual Information Technology Laboratory, Urumqi 830017, China.

Summary

This study introduces wav2vec-F, an improved model for low-resource speech recognition, enhancing performance for languages like Kazakh. Multi-language pre-training and speech synthesis significantly reduce word error rates, making ASR more accessible.

Related Concept Videos