会议任务专题

ICASSP 2026 - 声源定位

共 15 篇 ICASSP 2026 声源定位 方向论文

 · 更新于 2026-09-25 · 约 42 分钟 · 20554 字 阅读 →
论文解读

Improving Binaural Distance Estimation in Reverberant Rooms Through Contrastive And Multi-Task Learning

声源定位 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4718 字 阅读 →
论文解读

Microphone-Less Measurement of Three-Dimensional Radiating Impulse Response of Sound Source using Spherical Harmonic-Domain Acousto-Optic Tomography

声源定位 | 7.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3643 字 阅读 →
论文解读

Non-Line-of-Sight Vehicle Detection via Audio-Visual Fusion

音频分类 | 8.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4086 字 阅读 →
论文解读

Physics-Informed Neural Networks for Ocean Acoustic Field Reconstruction and Source Localization

声源定位 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3605 字 阅读 →
论文解读

Reconstruction of Spherical Sound Source Radiation Characteristics with Graph Signal Processing

空间音频 | 7.5/10

 · 更新于 2026-09-25 · 约 7 分钟 · 3232 字 阅读 →
论文解读

SELD-MOHA: A Fine-Tuning Method with the Mixture of Heterogeneous Adapters for Sound Event Localization and Detection

音频事件检测 | 7.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5325 字 阅读 →
论文解读

Sequential and Simultaneous Optimization of Microphone Array Geometry and Region-of-Interest Beamforming

声源定位 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4818 字 阅读 →
论文解读

Single-Microphone Audio Point Source Discriminative Localization from Reverberation Late Tail Estimation

说话人分离 | 7.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3846 字 阅读 →
论文解读

SIRUP: A Diffusion-Based Virtual Upmixer of Steering Vectors for Highly-Directive Spatialization with First-Order Ambisonics

声源定位 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4466 字 阅读 →
论文解读

Spatial-CLAP: Learning Spatially-Aware Audio–Text Embeddings for Multi-Source Conditions

空间音频 | 8.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4905 字 阅读 →
论文解读

Spiking Attention Network: A Hybrid Neuromorphic Approach to Underwater Acoustic Localization and Zero-Shot Adaptation

声源定位 | 7.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3981 字 阅读 →
论文解读

Theory and Application of Circular Relative Harmonic Coefficients

声源定位 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4582 字 阅读 →
论文解读

Triad: Tri-Head with Auxiliary Duplicating Permutation Invariant Training for Multi-Task Sound Event Localization and Detection

音频事件检测 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4020 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-29

共分析 29 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 87 分钟 · 43144 字 阅读 →
论文解读

Predictive Directional Selective Fixed-Filter Active Noise Control for Moving Sources via a Convolutional Recurrent Neural Network

声源定位 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3941 字 阅读 →
论文解读

Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction

本文旨在解决音频-视觉导航(AVN)智能体在未见环境和未闻声音类别下泛化能力差的核心问题。作者指出,现有方法性能下降主要源于两个因素:一是音频表征混淆了语义与空间信息,导致对未闻声��定位不准;二是强化学习策略过拟合于训练环境的动态和布局。为此,本文提出了一个名为BDATP的即插即用框架。在感知层面

 · 更新于 2026-09-25 · 约 11 分钟 · 5221 字 阅读 →
论文解读

Spatial-Aware Conditioned Fusion for Audio-Visual Navigation

本论文针对音频-视觉导航(AVN)中目标空间意图模糊、视觉特征缺乏听觉条件引导两大问题,提出了 Spatial-Aware Conditioned Fusion(SACF)框架。该框架首先设计了 Spatially Discretized Localization Descriptor(SDLD),

 · 更新于 2026-09-25 · 约 10 分钟 · 4579 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-20

共分析 24 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 50 分钟 · 24566 字 阅读 →
论文解读

Sky-Ear: An Unmanned Aerial Vehicle-Enabled Victim Sound Detection and Localization System

本文针对无人机搜救任务中视觉系统受遮蔽、能耗高的问题,提出了一个名为“Sky-Ear”的音频驱动受害者检测与定位系统。核心方法是设计了一个基于环形麦克风阵列的两阶段处理框架:在“哨兵阶段”,系统利用单

 · 更新于 2026-09-25 · 约 13 分钟 · 6117 字 阅读 →