paper-with-me

Speech Enhancement 벤치마크

Speech Enhancement on VoiceBank + DEMAND

42개 결과 · ⬇ CSV · JSON

PESQ (wb)

2.7 3.022 3.345 3.668 3.99 2019-05 2026-09 MetricGAN — 2.86 (2019-05-13) DCT — 2.7 (2019-10-17) RDL-Net 3.91M (Deep Xi - MMSE-LSA) — 3.02 (2020-02-27) RDL-Net 3.91M (Deep Xi - SRWF) — 2.94 (2020-02-27) RDL-Net 1.87M (Deep Xi - MMSE-LSA) — 2.93 (2020-02-27) RDL-Net 1.87M (Deep Xi - SRWF) — 2.84 (2020-02-27) DEMUCS (H=64, S=2 ,U =2) — 3.07 (2020-06-23) Causal DEMUCS (H=48,S=4, U =4) — 2.93 (2020-06-23) PERL-AE — 3.17 (2020-10-22) PFPL — 3.15 (2020-10-28) D2Former — 3.43 (2021-02-03) real-time-GRU — 2.82 (2021-02-15) MetricGAN+ — 3.15 (2021-04-08) MANNER — 3.21 (2022-03-04) PCS — 3.35 (2022-03-31) BSSE-SE — 3.2 (2022-04-07) SGMSE+ (Diffusion Model) — 2.93 (2022-08-11) MANNER-S + MV-AT (8.1GF) — 3.12 (2022-08-22) CMGAN — 3.41 (2022-09-22) SCP-CMGAN — 3.52 (2022-10-26) D²Net — 3.27 (2022-11-21) DeepFilterNet3 — 3.17 (2023-05-14) MetricGAN-OKD — 3.24 (2023-07-24) MetricGAN-OKD (Causal Arch.) — 3.12 (2023-07-24) MP-SENet — 3.6 (2023-08-17) ROSE — 3.01 (2023-12-11) SGMSE+ — 3.11 (2024-02-01) FSPEN — 2.97 (2024-04-15) SEMamba (+PCS) — 3.69 (2024-05-10) PESQetarian — 3.82 (2024-06-05) aTENNuate — 3.27 (2024-09-05) Schrödinger bridge (PESQ loss) — 3.7 (2024-09-16) Dense-TSNet — 3.05 (2024-09-18) Mamba-SEUNet L (+PCS) — 3.73 (2024-12-21) xLSTM-SENet2 — 3.53 (2025-01-10) Centaurus (0.51M) — 3.25 (2025-01-22) PrimeK-Net — 3.61 (2025-02-27) ROSE-CD(PESQ) — 3.99 (2025-07-08) ROSE-CD — 3.49 (2025-07-08) MetricGAN — 2.86 (2019-05-13) RDL-Net 3.91M (Deep Xi - MMSE-LSA) — 3.02 (2020-02-27) DEMUCS (H=64, S=2 ,U =2) — 3.07 (2020-06-23) PERL-AE — 3.17 (2020-10-22) D2Former — 3.43 (2021-02-03) SCP-CMGAN — 3.52 (2022-10-26) MP-SENet — 3.6 (2023-08-17) SEMamba (+PCS) — 3.69 (2024-05-10) PESQetarian — 3.82 (2024-06-05) ROSE-CD(PESQ) — 3.99 (2025-07-08)
RankModel PESQ (wb)CBAKCOVLCSIGSTOIESTOISSNRSI-SDR PaperCodeYear
1 ROSE-CD(PESQ) 3.993.374.304.6392.60.830.9270.40 Robust One-step Speech Enhancement via Consistency Distillation LiangXu123/Robust-One-step-Speech-Enhancement-via-Consistency-Distillation-ROSE-CD- 2025
2 PESQetarian 3.822.493.53.630.920.84-2.72-19.8 The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement 2024
3 Mamba-SEUNet L (+PCS) 3.733.674.404.8296––– Mamba-SEUNet: Mamba UNet for Monaural Speech Enhancement MyParadise21/Mamba-SEUNet 2024
4 Schrödinger bridge (PESQ loss) 3.70––––––– Investigating Training Objectives for Generative Speech Enhancement sp-uhh/sgmse 2024
5 SEMamba (+PCS) 3.693.634.374.7996––– An Investigation of Incorporating Mamba for Speech Enhancement roychao19477/semamba 2024
6 ZipEnhancer (S, \lamba_6 = 0) 3.633.874.364.8196.19–8.3319.09
7 PrimeK-Net 3.613.984.354.8196––– PrimeK-Net: Multi-scale Spectral Learning via Group Prime-Kernel Convolutional Neural Networks for Single Channel Speech Enhancement huaidanquede/PrimeK-Net 2025
7 ZipEnhancer (S, \lamba_6 = 0.2) 3.613.974.354.8196.22–10.0119.96
9 MP-SENet 3.603.994.344.810.96––– Explicit Estimation of Magnitude and Phase Spectra in Parallel for High-Quality Speech Enhancement yxlu-0102/MP-SENet 2023
10 PCS_CS_WAVLM 3.543.494.204.750.96–––
11 xLSTM-SENet2 3.533.984.274.780.96––– xLSTM-SENet: xLSTM for Single-Channel Speech Enhancement nikolaikyhne/xlstm-senet 2025
12 SCP-CMGAN 3.523.974.254.7596–10.82– SCP-GAN: Self-Correcting Discriminator Optimization for Training Consistency Preserving Metric GAN on Speech Enhancement Tasks 2022
13 ROSE-CD 3.493.334.044.52394.730.873.3417.80 Robust One-step Speech Enhancement via Consistency Distillation LiangXu123/Robust-One-step-Speech-Enhancement-via-Consistency-Distillation-ROSE-CD- 2025
14 D2Former 3.43––––––– Monaural Speech Enhancement with Complex Convolutional Block Attention Module and Joint Time Frequency Losses modelscope/ClearerVoice-Studio · alibabasglab/frcrn 2021
15 CMGAN 3.413.944.124.6396–11.1– CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement ruizhecao96/cmgan · SherifAbdulatif/CMGAN 2022
16 PCS 3.35–3.924.4395––– Perceptual Contrast Stretching on Target Feature for Speech Enhancement roychao19477/pcs 2022
17 D²Net 3.273.183.924.6396––– D²Net: A Denoising and Dereverberation Network Based on Two-branch Encoder and Dual-path Transformer 2022
17 aTENNuate 3.272.853.964.57–––15.04 aTENNuate: Optimized Real-time Speech Enhancement with Deep SSMs on Raw Audio 2024
19 Centaurus (0.51M) 3.25––––––– Let SSMs be ConvNets: State-space Modeling with Optimal Tensor Contractions 2025
20 MetricGAN-OKD 3.243.073.734.23–––– MetricGAN-OKD: Multi-Metric Optimization of MetricGAN via Online Knowledge Distillation for Speech Enhancement wooseok-shin/MetricGAN-OKD 2023
1–20 / 42 다음 → 페이지당 10 20 50 100