paper-with-me

Papers

ModDrop: adaptive multi-modal gesture recognition

2014-12-31 · Natalia Neverova, Christian Wolf, Graham W. Taylor, Florian Nebout

We present a method for gesture detection and localisation based on multi-scale and multi-modal deep learning. Each visual modality captures spatial information at a particular spatial scale (such as motion of the upper body or a hand), and the whole system operates at three temporal scales. Key to our technique is a training strategy which exploits: i) careful initialization of individual modalities; and ii) gradual fusion involving random dropping of separate channels (dubbed ModDrop) for learning cross-modality correlations while preserving uniqueness of each modality-specific representation. We present experiments on the ChaLearn 2014 Looking at People Challenge gesture recognition track, in which we placed first out of 17 teams. Fusing multiple modalities at several spatial and temporal scales leads to a significant increase in recognition rates, allowing the model to compensate for errors of the individual classifiers as well as noise in the separate channels. Futhermore, the proposed ModDrop training technique ensures robustness of the classifier to missing signals in one or several channels to produce meaningful predictions from any number of available modalities. In addition, we demonstrate the applicability of the proposed fusion scheme to modalities of arbitrary nature by experiments on the same dataset augmented with audio.

📄 PDF Abstract BibTeX arXiv:1501.00102

Code (0)

등록된 구현이 없습니다.

Tasks

Gesture Recognition

Similar Papers 제목 키워드 기반

ModDrop++: A Dynamic Filter Network with Intra-subject Co-training for Multiple Sclerosis Lesion Segmentation with Missing Modalities

2022-03-07 · Han Liu, Yubo Fan, Hao Li, Jiacheng Wang 외

Multiple Sclerosis (MS) is a chronic neuroinflammatory disease and multi-modality MRIs are routinely used to monitor MS lesions. Many automatic MS lesion segmentation models have been developed and have reached human-lev…

Lesion Segmentation

Motion Reinforces Appearance: RGB-Skeleton Gated Residual Fusion for Micro-Gesture Online Recognition

2026-06-10 · Jialin Liu, Xinwen He, Pengyu Liu, Jiale Shi 외 arxiv

Micro-gesture analysis attracts increasing attention for inferring spontaneous emotion from subtle body movements. Micro-gesture online recognition, which localizes and classifies each gesture instance in untrimmed video…

Action Detection

Multi-Task and Multi-Modal Learning for RGB Dynamic Gesture Recognition

2021-10-29 · Dinghao Fan, Hengjie Lu, Shugong Xu, Shan Cao

Gesture recognition is getting more and more popular due to various application possibilities in human-machine interaction. Existing multi-modal gesture recognition systems take multi-modal data as input to improve accur…

DecoderGesture RecognitionMulti-Task LearningSegmentation

Multi-modal Fusion for Single-Stage Continuous Gesture Recognition

2020-11-10 · Harshala Gammulle, Simon Denman, Sridha Sridharan, Clinton Fookes

Gesture recognition is a much studied research area which has myriad real-world applications including robotics and human-machine interaction. Current gesture recognition methods have focused on recognising isolated gest…

Gesture Recognition

An Evolutionary Network Architecture Search Framework with Adaptive Multimodal Fusion for Hand Gesture Recognition

2024-03-27 · Yizhang Xia, Shihao Song, Zhanglu Hou, Junwen Xu 외

Hand gesture recognition (HGR) based on multimodal data has attracted considerable attention owing to its great potential in applications. Various manually designed multimodal deep networks have performed well in multimo…

Gesture RecognitionHand Gesture RecognitionHand-Gesture Recognition