会议任务专题
ICASSP 2026 - 声源定位
共 15 篇 ICASSP 2026 声源定位 方向论文
共 15 篇 ICASSP 2026 声源定位 方向论文
声源定位 | 7.0/10
声源定位 | 7.0/10
音频分类 | 8.0/10
声源定位 | 7.5/10
空间音频 | 7.5/10
音频事件检测 | 7.0/10
声源定位 | 7.5/10
说话人分离 | 7.0/10
声源定位 | 7.0/10
空间音频 | 8.5/10
声源定位 | 7.0/10
声源定位 | 7.5/10
音频事件检测 | 7.5/10
共分析 29 篇语音/AI 论文
声源定位 | 7.5/10
本文旨在解决音频-视觉导航(AVN)智能体在未见环境和未闻声音类别下泛化能力差的核心问题。作者指出,现有方法性能下降主要源于两个因素:一是音频表征混淆了语义与空间信息,导致对未闻声��定位不准;二是强化学习策略过拟合于训练环境的动态和布局。为此,本文提出了一个名为BDATP的即插即用框架。在感知层面
本论文针对音频-视觉导航(AVN)中目标空间意图模糊、视觉特征缺乏听觉条件引导两大问题,提出了 Spatial-Aware Conditioned Fusion(SACF)框架。该框架首先设计了 Spatially Discretized Localization Descriptor(SDLD),
共分析 24 篇语音/AI 论文
本文针对无人机搜救任务中视觉系统受遮蔽、能耗高的问题,提出了一个名为“Sky-Ear”的音频驱动受害者检测与定位系统。核心方法是设计了一个基于环形麦克风阵列的两阶段处理框架:在“哨兵阶段”,系统利用单