TMMF: Temporal Multi-Modal Fusion for Single-Stage Continuous Gesture Recognition.

Summary

This study introduces a novel single-stage framework for continuous gesture recognition, Temporal Multi-Modal Fusion (TMMF), which detects and classifies multiple gestures in videos. The TMMF framework outperforms existing methods by learning natural gesture transitions without pre-processing segmentation.