An Envelope Separation Aided Multi-Task Learning Model for Blind Source Counting and Localization

Citation:

Du J, Wu D, Wu X, Qu T. An Envelope Separation Aided Multi-Task Learning Model for Blind Source Counting and Localization, in IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP). Barcelona, Spain; 2026:14852-14856.

Date Presented:

May 03-08

摘要:

Sound source localization (SSL) under unknown or variable sound sources conditions remains a challenging task. Existing methods suffer from limitations such as grid resolution constraints, fixed output dimensionality and insufficient exploitation of mutual assitance between temporal and spatial information. In this paper, we propose an Envelope Separation Aided Multi-Task Learning model for blind source counting and localization, which adaptively generates attractors to estimate source numbers and jointly optimizes envelope separation and direction estimation through a multi-task learning model using permutation invariant training (PIT). Experimental results demonstrated that the proposed model achieved better performance, by leveraging temporal domain envelope separation to aid spatial localization, outperforming baseline approaches.

访问链接