paper-with-me

홈 › Papers

Cocoon: Robust Multi-Modal Perception with Uncertainty-Aware Sensor Fusion

2024-10-16 · Minkyoung Cho, Yulong Cao, Jiachen Sun, Qingzhao Zhang, Marco Pavone, Jeong Joon Park, Heng Yang, Z. Morley Mao

An important paradigm in 3D object detection is the use of multiple modalities to enhance accuracy in both normal and challenging conditions, particularly for long-tail scenarios. To address this, recent studies have explored two directions of adaptive approaches: MoE-based adaptive fusion, which struggles with uncertainties arising from distinct object configurations, and late fusion for output-level adaptive fusion, which relies on separate detection pipelines and limits comprehensive understanding. In this work, we introduce Cocoon, an object- and feature-level uncertainty-aware fusion framework. The key innovation lies in uncertainty quantification for heterogeneous representations, enabling fair comparison across modalities through the introduction of a feature aligner and a learnable surrogate ground truth, termed feature impression. We also define a training objective to ensure that their relationship provides a valid metric for uncertainty quantification. Cocoon consistently outperforms existing static and adaptive methods in both normal and challenging conditions, including those with natural and artificial corruptions. Furthermore, we show the validity and efficacy of our uncertainty metric across diverse datasets.

📄 PDF Abstract BibTeX arXiv:2410.12592

Code (0)

등록된 구현이 없습니다.

Tasks

3D Object DetectionObjectobject-detectionObject DetectionSensor FusionUncertainty Quantificationvalid

Similar Papers 제목 키워드 기반

MUSES: The Multi-Sensor Semantic Perception Dataset for Driving under Uncertainty

2024-01-23 · Tim Brödermann, David Bruggemann, Christos Sakaridis, Kevin Ta 외

Achieving level-5 driving automation in autonomous vehicles necessitates a robust semantic visual perception system capable of parsing data from different sensors across diverse conditions. However, existing semantic per…

Autonomous VehiclesObject DetectionPanoptic SegmentationSemantic Segmentation+1

Cocoon: A System Architecture for Differentially Private Training with Correlated Noises

2025-10-08 · Donghwan Kim, Xin Gu, Jinho Baek, Timothy Lo 외 arxiv

Machine learning (ML) models memorize and leak training data, causing serious privacy issues to data owners. Training algorithms with differential privacy (DP), such as DP-SGD, have been gaining attention as a solution. …

Latent Distribution Decoupling: A Probabilistic Framework for Uncertainty-Aware Multimodal Emotion Recognition

2025-02-19 · Jingwang Huang, Jiang Zhong, Qin Lei, Jinpeng Gao 외

Multimodal multi-label emotion recognition (MMER) aims to identify the concurrent presence of multiple emotions in multimodal data. Existing studies primarily focus on improving fusion strategies and modeling modality-to…

Emotion RecognitionMultimodal Emotion Recognition

Active Asymmetric Multi-Agent Multimodal Learning under Uncertainty

2026-02-04 · Rui Liu, Pratap Tokekar, Ming Lin arxiv

Multi-agent systems are increasingly equipped with heterogeneous multimodal sensors, enabling richer perception but introducing modality-specific and agent-dependent uncertainty. Existing multi-agent collaboration framew…

Autonomous Driving

Gaussian Mixture-Based Inverse Perception Contract for Uncertainty-Aware Robot Navigation

2026-03-04 · Bingyao Du, Joonkyung Kim, Yiwei Lyu arxiv

Reliable navigation in cluttered environments requires perception outputs that are not only accurate but also equipped with uncertainty sets suitable for safe control. An inverse perception contract (IPC) provides such a…

Robot Navigation