下限增益保住弱语音:用逐帧贝塔约束修补判决引导增强
针对低信噪比下判决引导增益过度衰减弱语音的问题,论文提出逐帧下限增益的 ABCDD 结构并用轻量 MLP 自动预测贝塔,在代表性样本上全面优于谱减法和经典 DD,在 100 条未见 VoiceBank-DEMAND 测试上把平均对齐信噪比从 9.41 dB 提升到 13.82 dB,代价是贝塔过大仍会残留噪声且感知质量未验证。
针对低信噪比下判决引导增益过度衰减弱语音的问题,论文提出逐帧下限增益的 ABCDD 结构并用轻量 MLP 自动预测贝塔,在代表性样本上全面优于谱减法和经典 DD,在 100 条未见 VoiceBank-DEMAND 测试上把平均对齐信噪比从 9.41 dB 提升到 13.82 dB,代价是贝塔过大仍会残留噪声且感知质量未验证。
针对漫射噪声下单目标实时提取问题,论文用最大加权似然把 NSR-ILRMA 与 RCSCME 改写为逐帧在线更新,并在静止与移动说话人仿真及真实录音中对比在线与分块批处理路线,其代价是每帧仍需矩阵求逆加速与稳定性控制且处理时间接近移位长度。
针对三角函数链非线性建模局部化不足的问题,该文用零中心高斯包络乘三角基构造固定维 GTFLN 并推导缩放参数局部优化的 OGTFLN 与稳态超量均方误差,最强证据是多组非线性系统辨识与回声对消和有源控制实验中更低的稳态误差和噪声残留,代价是 OGTFLN 求优化参数的额外计算量和对匹配次级通道等条件的依赖。
共收录 160 篇 nime-2026 会议论文的 Reader 深度解读
针对一阶与二阶时变全通滤波器在系数快速变化时输出超过限幅阈值的问题,论文用静态对照输出加系数增量界把输出约束在阈值内,正弦与音乐片段实验显示其在标准结构和能量保持结构各自削波的方向上均不削波,代价是短暂偏离目标系数轨迹并引入少量逐样本判断与除法运算。
论文把自适应房间均衡做成闭环可微分控制,用 7 段参量均衡加频域误差在实测时变房间脉冲响应和音乐激励下跟踪目标响应,最强证据是频域目标相对未均衡把系统距离压低约 7 成而时域误差全配置不收敛,代价是对在线房间估计质量敏感且高阶优化器单帧耗时接近帧长。
针对多通道前馈主动噪声控制中次级扬声器到参考麦的声反馈在主噪声持续存在时难以标定的问题,论文提出用参考组到反馈组的相对传递矩阵加协方差相减来估计并扣除反馈分量,仿真报告显示其降噪接近理想无主噪声标定上界而直接估计与无补偿基线失稳或仅约负 2 分贝,代价是需要两次受控测量与额外反馈麦组。
针对增强现实眼镜耳处无误差麦克风导致无法直接做有源噪声控制的问题,论文验证辅助滤波器虚拟传感的必要性并推导其方向敏感性,用自由场仿真显示固定滤波器在方向失配时退化,而按声源方向从有限滤波器库中选择可在因果区内部分恢复性能,但仍不及逐方向重标定。
针对长回声路径辨识问题,论文把长度为 L 的脉冲响应拆成两个短分量滤波器并为各自设计可变遗忘因子,在网络与声学回声消除仿真中报告了比固定遗忘因子 RLS-NKP 更低失调与更快跟踪,但未给出失调数值的表格且依赖对角协方差等简化假设。
共收录 91 篇 dafx-2026 会议论文的 Reader 深度解读
共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读
论文把传声器信号写成声源经无限冲激响应的卷积,证明在环路延迟足够长且该无限冲激响应可用有限冲激响应近似时反馈分量落入晚期混响段,从而用加权预测误差去混响做联合去混响与声反馈抑制,仿真显示其在 6 dB 与 -6 dB 增益裕量下均优于连续自适应滤波器,代价是依赖延迟条件与有限冲激响应近似。
针对听音者移动导致声传递函数变化时时域 FxLMS 加 RLS 在线建模计算重、重收敛慢的问题,论文提出频域极坐标 FxNLMS 加 NLMS 声路径跟踪与声对比度驱动变步长,在 10 扬声器仿真中把每帧计算量降低约 99.94% 并把移动后重收敛时间常数从 33.11 s 缩短到 3.71 s,代价是仍只在自由场白噪声仿真中验证且依赖多组 Sigmoid …
针对高密度蜂窝网络下数百部手机难以维持双向同步的问题,千机采用单向广播加无状态对时与离线空间乐谱,把连接存活放在相位精度之前,用 421 部手机的公演与 2000+ 连接的压测验证连续性,代价是放弃逐设备交互与现场定量同步数据。
针对加性噪声下传统加权预测误差去混响鲁棒性下降和多通道延迟观测导致矩阵求逆复杂度为 O(M^3L^3) 的问题,论文用观测自相关矩阵主特征向量重建参考信号并压缩延迟观测子空间,在 8 麦克、混响时间 800 毫秒、白噪声与扩散噪声各两种信噪比仿真中提升去混响增益,代价是压缩维度与迭代近似带来性能与复杂度权衡。
针对声源活动范围大致已知但精确位置未知的多通道分离问题,论文把导向矢量约束在预测导向矢量张成的低维子空间内并扩展迭代源导向框架,用固定与灵活两种子空间维度配置在四声源混响仿真中对照标准 ISS 与平均导向矢量 MVDR,代价是仍依赖预测网格与混响条件且原文未给出可复述的逐点数值。
自适应滤波 | 6.5/10
自适应滤波 | 8/10
自适应滤波 | 5.3/10
自适应滤波 | 8/10