Prompt Tuning of Deep Neural Networks for Speaker-Adaptive Visual Speech Recognition

Summary

Prompt tuning enhances Visual Speech Recognition (VSR) for unseen speakers by adapting models with minimal data. This method improves VSR performance without altering core deep neural network parameters.