paper-with-me

Sound Source Localization

1개 벤치마크 · 논문 122편 · 이 태스크의 논문 보기 →

Benchmarks

^(#$!@#$)(()))******

결과 1개

Most implemented

Papers

S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information

2026-07-28 · Kaneyoshi Hiratsuka, Benjamin Yen, Ryosuke Kojima arxiv

Acoustic information provides rich cues about object location, material properties, and changes caused by contact or motion. This paper introduces a new set of acoustic-aware manipulation tasks for imitation learning, in…

Sound Source Localization

SelectTSL: Prompt-Guided Selective Target Sound Localization in Complex Scenarios

2026-07-02 · Ziyang Jiang, Yu Chen, Zexu Pan, Xinyuan Qian 외 arxiv

Humans can selectively attend to a target sound and estimate its direction in complex scenarios, whereas such selective localization remains challenging for current deep learning-based systems. Sound source localization …

Sound Source LocalizationTarget Sound Extraction

NeuralMUSIC: A Hybrid Neural-Subspace Framework for Robot Sound Source Localization

2026-06-17 · Yizhuo Yang, Junqiao Fan, Shenghai Yuan, Lihua Xie arxiv

Reliable sound source localization is fundamental to robot audition, enabling autonomous robots to perceive spatial cues and operate effectively in dynamic environments. Classical methods such as Multiple Signal Classifi…

Sound Source LocalizationDomain Generalization

Initiation of Interaction Detection Framework using a Nonverbal Cue for Human-Robot Interaction

2026-05-11 · Guhnoo Yun, Juhan Yoo, Kijung Kim, Dong Hwan Kim arxiv

This paper describes an initiation of interaction(IoI) detection framework without keywords for human-robot interaction(HRI) based on audio and vision sensor fusion in a domestic environment. In the proposed framework, t…

Sound Source Localization

Generate, Analyze, and Refine: Training-Free Sound Source Localization via MLLM Meta-Reasoning

2026-04-08 · Subin Park, Jung Uk Kim arxiv

Sound source localization task aims to identify the locations of sound-emitting objects by leveraging correlations between audio and visual modalities. Most existing SSL methods rely on contrastive learning-based feature…

Sound Source LocalizationContrastive Learning

RA-SSU: Towards Fine-Grained Audio-Visual Learning with Region-Aware Sound Source Understanding

2026-03-10 · Muyi Sun, Yixuan Wang, Hong Wang, Chen Su 외 arxiv

Audio-Visual Learning (AVL) is one fundamental task of multi-modality learning and embodied intelligence, displaying the vital role in scene understanding and interaction. However, previous researchers mostly focus on ex…

audio-visual event localizationSound Source LocalizationScene Understanding

전체 122편 보기 →