paper-with-me

Audio Classification 벤치마크

Audio Classification on Balanced Audio Set

16개 결과 · ⬇ CSV · JSON

Mean AP

27.6 31.3 35 38.7 42.4 2021-10 2026-09 Conformer — 27.6 (2021-10-14) Conformer — 27.6 (2021-10-14) SSAST-PATCH — 31.0 (2021-10-19) SSAST-FRAME — 29.2 (2021-10-19) SSAST-PATCH — 31.0 (2021-10-19) SSAST-FRAME — 29.2 (2021-10-19) Base (ours) — 37.4 (2022-04-26) Base (ours) — 37.4 (2022-04-26) BEATs — 38.9 (2022-12-18) BEATs — 38.9 (2022-12-18) EAT — 40.3 (2024-01-07) EAT — 40.3 (2024-01-07) EquiAV — 42.4 (2024-03-14) EquiAV — 42.4 (2024-03-14) SSLAM — 40.9 (2025-06-13) SSLAM — 40.9 (2025-06-13) Conformer — 27.6 (2021-10-14) SSAST-PATCH — 31.0 (2021-10-19) Base (ours) — 37.4 (2022-04-26) BEATs — 38.9 (2022-12-18) EAT — 40.3 (2024-01-07) EquiAV — 42.4 (2024-03-14)
RankModel Mean AP PaperCodeYear
1 EquiAV 42.4 EquiAV: Leveraging Equivariance for Audio-Visual Contrastive Learning jongsuk1/equiav 2024
2 SSLAM 40.9 SSLAM: Enhancing Self-Supervised Models with Audio Mixtures for Polyphonic Soundscapes ta012/SSLAM 2025
3 EAT 40.3 EAT: Self-Supervised Pre-Training with Efficient Audio Transformer cwx-worst-one/eat 2024
4 BEATs 38.9 BEATs: Audio Pre-Training with Acoustic Tokenizers microsoft/unilm · Yui010206/CREMA · qingyuliu0521/icsd · +1 2022
5 Base (ours) 37.4 ATST: Audio Representation Learning with Teacher-Student Transformer Audio-WestlakeU/ATST-SED · Audio-WestlakeU/audiossl · 2024-MindSpore-1/Code6 · +1 2022
6 SSAST-PATCH 31.0 SSAST: Self-Supervised Audio Spectrogram Transformer YuanGongND/ast · YuanGongND/ssast · siavashshams/ssamba 2021
7 SSAST-FRAME 29.2 SSAST: Self-Supervised Audio Spectrogram Transformer YuanGongND/ast · YuanGongND/ssast · siavashshams/ssamba 2021
8 Conformer 27.6 Conformer-Based Self-Supervised Learning for Non-Speech Audio Tasks 2021
9 EquiAV 42.4 EquiAV: Leveraging Equivariance for Audio-Visual Contrastive Learning jongsuk1/equiav 2024
10 SSLAM 40.9 SSLAM: Enhancing Self-Supervised Models with Audio Mixtures for Polyphonic Soundscapes ta012/SSLAM 2025
11 EAT 40.3 EAT: Self-Supervised Pre-Training with Efficient Audio Transformer cwx-worst-one/eat 2024
12 BEATs 38.9 BEATs: Audio Pre-Training with Acoustic Tokenizers microsoft/unilm · Yui010206/CREMA · qingyuliu0521/icsd · +1 2022
13 Base (ours) 37.4 ATST: Audio Representation Learning with Teacher-Student Transformer Audio-WestlakeU/ATST-SED · Audio-WestlakeU/audiossl · 2024-MindSpore-1/Code6 · +1 2022
14 SSAST-PATCH 31.0 SSAST: Self-Supervised Audio Spectrogram Transformer YuanGongND/ast · YuanGongND/ssast · siavashshams/ssamba 2021
15 SSAST-FRAME 29.2 SSAST: Self-Supervised Audio Spectrogram Transformer YuanGongND/ast · YuanGongND/ssast · siavashshams/ssamba 2021
16 Conformer 27.6 Conformer-Based Self-Supervised Learning for Non-Speech Audio Tasks 2021
1–16 / 16 페이지당 10 20 50 100