paper-with-me

Papers

ADM-DP: Adaptive Dynamic Modality Diffusion Policy through Vision-Tactile-Graph Fusion for Multi-Agent Manipulation

2026-02-25 · Enyi Wang, Wen Fan, Dandan Zhang arxiv

Multi-agent robotic manipulation remains challenging due to the combined demands of coordination, grasp stability, and collision avoidance in shared workspaces. To address these challenges, we propose the Adaptive Dynamic Modality Diffusion Policy (ADM-DP), a framework that integrates vision, tactile, and graph-based (multi-agent pose) modalities for coordinated control. ADM-DP introduces four key innovations. First, an enhanced visual encoder merges RGB and point-cloud features via Feature-wise Linear Modulation (FiLM) modulation to enrich perception. Second, a tactile-guided grasping strategy uses Force-Sensitive Resistor (FSR) feedback to detect insufficient contact and trigger corrective grasp refinement, improving grasp stability. Third, a graph-based collision encoder leverages shared tool center point (TCP) positions of multiple agents as structured kinematic context to maintain spatial awareness and reduce inter-agent interference. Fourth, an Adaptive Modality Attention Mechanism (AMAM) dynamically re-weights modalities according to task context, enabling flexible fusion. For scalability and modularity, a decoupled training paradigm is employed in which agents learn independent policies while sharing spatial information. This maintains low interdependence between agents while retaining collective awareness. Across seven multi-agent tasks, ADM-DP achieves 12-25% performance gains over state-of-the-art baselines. Ablation studies show the greatest improvements in tasks requiring multiple sensory modalities, validating our adaptive fusion strategy and demonstrating its robustness for diverse manipulation scenarios.

📄 PDF Abstract BibTeX arXiv:2602.21622

Code (0)

등록된 구현이 없습니다.

Tasks

Collision Avoidance

Similar Papers 제목 키워드 기반

FA-RDP: A Frequency-Adaptive Reactive Diffusion Policy for Contact-Rich Manipulation

2026-07-30 · Lifeng Zhuo, Wendi Chen, Han Xue, Shirun Tang 외 arxiv

In contact-rich manipulation, action multimodality and reactivity dominate different stages of a single episode. Before contact, multiple trajectories might be equally valid, making it important to preserve diverse actio…

Modality-Composable Diffusion Policy via Inference-Time Distribution-level Composition

2025-03-16 · Jiahang Cao, Qiang Zhang, Hanzhong Guo, Jiaxu Wang 외

Diffusion Policy (DP) has attracted significant attention as an effective method for policy representation due to its capacity to model multi-distribution dynamics. However, current DPs are often based on a single visual…

DADP: Domain Adaptive Diffusion Policy

2026-02-03 · Pengcheng Wang, Qinghang Liu, Haotian Lin, Yiheng Li 외 arxiv

Learning domain adaptive policies that can generalize to unseen transition dynamics, remains a fundamental challenge in learning-based control. Substantial progress has been made through domain representation learning to…

Representation LearningDecision Making

Adaptive Diffusion Policy Optimization for Robotic Manipulation

2025-05-13 · Huiyun Jiang, Zhuang Yang

Recent studies have shown the great potential of diffusion models in improving reinforcement learning (RL) by modeling complex policies, expressing a high degree of multi-modality, and efficiently handling high-dimension…

continuous-controlContinuous ControlReinforcement Learning (RL)

Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets

2025-04-03 · Chuning Zhu, Raymond Yu, Siyuan Feng, Benjamin Burchfiel 외

Imitation learning has emerged as a promising approach towards building generalist robots. However, scaling imitation learning for large robot foundation models remains challenging due to its reliance on high-quality exp…

Imitation Learning