MMNet: A Model-Based Multimodal Network for Human Action Recognition in RGB-D Videos

Summary

This study introduces a novel multimodal network (MMNet) for human action recognition (HAR) using RGB-D videos. MMNet effectively fuses skeleton and RGB data, outperforming existing methods on multiple datasets.

Related Concept Videos