Audio Source Separation
2개 벤치마크 · 논문 117편 · 이 태스크의 논문 보기 →
Benchmarks
AudioSet
MUSIC (multi-source)
Most implemented
Wave-U-Net: A Multi-Scale Neural Network for End-to-End Audio Source Separation
Multi-scale Multi-band DenseNets for Audio Source Separation
Sudo rm -rf: Efficient Networks for Universal Audio Source Separation
The Cocktail Fork Problem: Three-Stem Audio Separation for Real-World Soundtracks
Compute and memory efficient universal sound source separation
Co-Separating Sounds of Visual Objects
Papers
Audio Source Separation in Reverberant Environments using $β$-divergence based Nonnegative Factorization
In Gaussian model-based multichannel audio source separation, the likelihood of observed mixtures of source signals is parametrized by source spectral variances and by associated spatial covariance matrices. These parame…
Audio Source SeparationA Knowledge-Driven Approach to Music Segmentation, Music Source Separation and Cinematic Audio Source Separation
We propose a knowledge-driven, model-based approach to segmenting audio into single-category and mixed-category chunks with applications to source separation. "Knowledge" here denotes information associated with the data…
Music Source SeparationAudio Source SeparationSAM Audio: Segment Anything in Audio
General audio source separation is a key capability for multimodal AI systems that can perceive and reason about sound. Despite substantial progress in recent years, existing separation models are either domain-specific,…
Audio Source SeparationRobustness of Minimum-Volume Nonnegative Matrix Factorization under an Expanded Sufficiently Scattered Condition
Minimum-volume nonnegative matrix factorization (min-vol NMF) has been used successfully in many applications, such as hyperspectral imaging, chemical kinetics, spectroscopy, topic modeling, and audio source separation. …
Audio Source SeparationOn Temporal Guidance and Iterative Refinement in Audio Source Separation
Spatial semantic segmentation of sound scenes (S5) involves the accurate identification of active sound classes and the precise separation of their sources from complex acoustic mixtures. Conventional systems rely on a t…
Audio Source SeparationSemantic SegmentationSound Event DetectionAudio TaggingTowards Reliable Objective Evaluation Metrics for Generative Singing Voice Separation Models
Traditional Blind Source Separation Evaluation (BSS-Eval) metrics were originally designed to evaluate linear audio source separation models based on methods such as time-frequency masking. However, recent generative mod…
Audio Source Separationblind source separation