论文解读
Low-Latency Audio Front-End Region-of-Interest Beamforming for Smart Glasses
语音增强 | 7.0/10
语音增强 | 7.0/10
语音增强 | 8.0/10
语音情感识别 | 7.5/10
语音分离 | 7.0/10
空间音频 | 7.5/10
语音分离 | 7.5/10
说话人分离 | 8.0/10
语音分离 | 7.0/10
主动噪声控制 | 7.0/10
声源定位 | 7.5/10
音频事件检测 | 5.5/10
共分析 13 篇语音/AI 论文
这篇论文旨在为无声言语接口(SSI)选择更优的中间表示目标。研究系统比较了发音特征(SPARC)和传统的音素独热编码,在预测表面肌电(sEMG)信号包络上的表现。核心发现是:1)在出声、默语和次发声三种模式下,SPARC特征的编码准确性均显著优于音素特征;2)出声和默语模式的编码性能相当,次发声模式
共分析 21 篇语音/AI 论文
本文针对混响环境下的多通道音频源分离问题,提出了一种基于β-散度非负因子分解的参数估计新方法。传统方法依赖期望最大化(EM)算法估计源频谱方差和空间协方差矩阵,本文则利用包含源频谱先验信息的基矩阵(可
共分析 39 篇语音/AI 论文