paper-with-me

Audio Classification

22개 벤치마크 · 논문 413편 · 이 태스크의 논문 보기 →

Benchmarks

AudioSet

결과 102개

ESC-50

결과 59개

VGGSound

결과 46개

SHD

결과 22개

FSD50K

결과 20개

Balanced Audio Set

결과 16개

Speech Commands

결과 14개

DCASE

결과 10개

SSC

결과 10개

BirdCLEF 2021

결과 8개

EPIC-KITCHENS-100

결과 8개

Audio Set

결과 6개

CREMA-D

결과 6개

DiCOVA

결과 6개

EPIC-SOUNDS

결과 6개

RAVDESS

결과 4개

VocalSound

결과 4개

Multimodal PISA

결과 2개

Most implemented

AST: Audio Spectrogram Transformer

2021-04-05 · 구현 5개

Papers

Few-Shot Open-Set Audio Classification via Transductive Prototype Refinement and Class Logit Enhancement

2026-07-29 · Tianyan Deng, Yanxiong Li, Rui Gao, Jiahao Du arxiv

Few-shot Open-set audio classification requires classifying query samples from known classes with a few labeled support samples while rejecting query samples from unknown classes. Transductive inference jointly observes …

Audio Classification

EdgeFaaS: A Function-based Framework for Edge Computing

2026-07-16 · Neha Vadnere, Yu-Ting Wang, Yitao Chen, Sreehari Sadesh 외 arxiv

Edge computing brings unique challenges as the resources on the edge are highly diverse in capabilities and capacities, and highly distributed across many users and the physical world. Existing distributed computing fram…

Audio ClassificationFederated Learning

TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios

2026-07-07 · Hong Lyu, Mingru Yang, Qianhua He, Yanxiong Li 외 arxiv

There are some datasets of varying scales for audio classification (AC) applied to different tasks. However, annotated data is limited for most scenarios, such as domestic environments. To address this challenge, we prop…

Audio Classification

A Multi-Branch Hierarchy-Aware Framework for Heterogeneous Audio Classification

2026-07-02 · Beile Ning, Jiayi Yu, Zitong Wang, Yufei Hu 외 arxiv

This technical report describes our system for Task 1 of the DCASE 2026 Challenge, which aims to classify heterogeneous audio recordings according to the Broad Sound Taxonomy (BST). The task requires both accurate second…

Audio Classification

Few-Shot Open-Set Audio Classification Using Attention Information-Fused Prototypes

2026-07-01 · Yanxiong Li, Jiaxin Tan, Qianqian Li, Guoqing Chen 외 arxiv

Most existing audio classification methods suppose that each query (testing) sample belongs to a class of support (training) samples, and misrecognize samples of unseen classes as seen classes (cannot reject samples of u…

Audio Classification

ZEBRA: Zero-Shot Entropy-Regularized Prompt Learning for Base-to-Novel Generalization in Audio-Language Models

2026-06-30 · Asif Hanif, Mohammad Yaqub arxiv

Audio-Language Models (ALMs) achieve strong zero-shot performance by aligning audio with textual class descriptions. Although prompt learning improves accuracy on base classes through few-shot supervised adaptation, we o…

Audio Classification

전체 413편 보기 →