论文解读

下限增益保住弱语音:用逐帧贝塔约束修补判决引导增强

针对低信噪比下判决引导增益过度衰减弱语音的问题,论文提出逐帧下限增益的 ABCDD 结构并用轻量 MLP 自动预测贝塔,在代表性样本上全面优于谱减法和经典 DD,在 100 条未见 VoiceBank-DEMAND 测试上把平均对齐信噪比从 9.41 dB 提升到 13.82 dB,代价是贝塔过大仍会残留噪声且感知质量未验证。

 · 约 17 分钟 · 8443 字 阅读 →
论文解读

在说话人移动时仍逐帧更新:以加权似然把 ILRMA 与 RCSCME 改写为在线算法

针对漫射噪声下单目标实时提取问题,论文用最大加权似然把 NSR-ILRMA 与 RCSCME 改写为逐帧在线更新,并在静止与移动说话人仿真及真实录音中对比在线与分块批处理路线,其代价是每帧仍需矩阵求逆加速与稳定性控制且处理时间接近移位长度。

 · 更新于 2026-09-24 · 约 20 分钟 · 9663 字 阅读 →
论文解读

用固定维高斯包络驯服三角基:GTFLN 的局部化、优化与稳态误差

针对三角函数链非线性建模局部化不足的问题,该文用零中心高斯包络乘三角基构造固定维 GTFLN 并推导缩放参数局部优化的 OGTFLN 与稳态超量均方误差,最强证据是多组非线性系统辨识与回声对消和有源控制实验中更低的稳态误差和噪声残留,代价是 OGTFLN 求优化参数的额外计算量和对匹配次级通道等条件的依赖。

 · 更新于 2026-09-24 · 约 16 分钟 · 7590 字 阅读 →
每日研究速递

nime-2026 论文深度解读

共收录 160 篇 nime-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 332 分钟 · 166159 字 阅读 →
论文解读

时变全通滤波器为何会削波:把系数增量关进阈值笼子

针对一阶与二阶时变全通滤波器在系数快速变化时输出超过限幅阈值的问题,论文用静态对照输出加系数增量界把输出约束在阈值内,正弦与音乐片段实验显示其在标准结构和能量保持结构各自削波的方向上均不削波,代价是短暂偏离目标系数轨迹并引入少量逐样本判断与除法运算。

 · 更新于 2026-09-24 · 约 26 分钟 · 12570 字 阅读 →
论文解读

时变房间里用音乐做激励:可微分参数均衡为何要换掉时域误差

论文把自适应房间均衡做成闭环可微分控制,用 7 段参量均衡加频域误差在实测时变房间脉冲响应和音乐激励下跟踪目标响应,最强证据是频域目标相对未均衡把系统距离压低约 7 成而时域误差全配置不收敛,代价是对在线房间估计质量敏感且高阶优化器单帧耗时接近帧长。

 · 更新于 2026-09-24 · 约 24 分钟 · 11623 字 阅读 →
论文解读

主噪声关不掉时,如何把扬声器漏进参考麦的声音减掉

针对多通道前馈主动噪声控制中次级扬声器到参考麦的声反馈在主噪声持续存在时难以标定的问题,论文提出用参考组到反馈组的相对传递矩阵加协方差相减来估计并扣除反馈分量,仿真报告显示其降噪接近理想无主噪声标定上界而直接估计与无补偿基线失稳或仅约负 2 分贝,代价是需要两次受控测量与额外反馈麦组。

 · 更新于 2026-09-24 · 约 18 分钟 · 8980 字 阅读 →
论文解读

眼镜框上有麦、耳朵处无麦:辅助滤波器为何在方向偏离时失效

针对增强现实眼镜耳处无误差麦克风导致无法直接做有源噪声控制的问题,论文验证辅助滤波器虚拟传感的必要性并推导其方向敏感性,用自由场仿真显示固定滤波器在方向失配时退化,而按声源方向从有限滤波器库中选择可在因果区内部分恢复性能,但仍不及逐方向重标定。

 · 更新于 2026-09-24 · 约 17 分钟 · 8360 字 阅读 →
论文解读

长脉冲响应拆成两个短滤波器:RLS-NKP 如何用两个可变遗忘因子兼顾精度与跟踪

针对长回声路径辨识问题,论文把长度为 L 的脉冲响应拆成两个短分量滤波器并为各自设计可变遗忘因子,在网络与声学回声消除仿真中报告了比固定遗忘因子 RLS-NKP 更低失调与更快跟踪,但未给出失调数值的表格且依赖对角协方差等简化假设。

 · 更新于 2026-09-24 · 约 17 分钟 · 8143 字 阅读 →
每日研究速递

dafx-2026 论文深度解读

共收录 91 篇 dafx-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 181 分钟 · 90282 字 阅读 →
每日研究速递

eusipco-2026 论文深度解读

共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 247 分钟 · 123292 字 阅读 →
论文解读

把回授当成晚期混响:去混响滤波器何以同时做声反馈抑制

论文把传声器信号写成声源经无限冲激响应的卷积,证明在环路延迟足够长且该无限冲激响应可用有限冲激响应近似时反馈分量落入晚期混响段,从而用加权预测误差去混响做联合去混响与声反馈抑制,仿真显示其在 6 dB 与 -6 dB 增益裕量下均优于连续自适应滤波器,代价是依赖延迟条件与有限冲激响应近似。

 · 更新于 2026-09-24 · 约 19 分钟 · 9074 字 阅读 →
论文解读

相位对不准就白做:用极坐标分开调幅度和相位的频域个人声区

针对听音者移动导致声传递函数变化时时域 FxLMS 加 RLS 在线建模计算重、重收敛慢的问题,论文提出频域极坐标 FxNLMS 加 NLMS 声路径跟踪与声对比度驱动变步长,在 10 扬声器仿真中把每帧计算量降低约 99.94% 并把移动后重收敛时间常数从 33.11 s 缩短到 3.71 s,代价是仍只在自由场白噪声仿真中验证且依赖多组 Sigmoid …

 · 更新于 2026-09-24 · 约 17 分钟 · 8126 字 阅读 →
论文解读

不断线比对得准更重要:千机用单向广播把数百部手机变成古琴共鸣体

针对高密度蜂窝网络下数百部手机难以维持双向同步的问题,千机采用单向广播加无状态对时与离线空间乐谱,把连接存活放在相位精度之前,用 421 部手机的公演与 2000+ 连接的压测验证连续性,代价是放弃逐设备交互与现场定量同步数据。

 · 更新于 2026-09-24 · 约 21 分钟 · 10433 字 阅读 →
论文解读

低信噪比下参考信号不可靠、矩阵太大:用主特征向量重建参考并压缩延迟观测的 WPE

针对加性噪声下传统加权预测误差去混响鲁棒性下降和多通道延迟观测导致矩阵求逆复杂度为 O(M^3L^3) 的问题,论文用观测自相关矩阵主特征向量重建参考信号并压缩延迟观测子空间,在 8 麦克、混响时间 800 毫秒、白噪声与扩散噪声各两种信噪比仿真中提升去混响增益,代价是压缩维度与迭代近似带来性能与复杂度权衡。

 · 更新于 2026-09-24 · 约 16 分钟 · 7985 字 阅读 →
论文解读

活动范围已知时,把导向矢量更新压进低维子空间做半盲分离

针对声源活动范围大致已知但精确位置未知的多通道分离问题,论文把导向矢量约束在预测导向矢量张成的低维子空间内并扩展迭代源导向框架,用固定与灵活两种子空间维度配置在四声源混响仿真中对照标准 ISS 与平均导向矢量 MVDR,代价是仍依赖预测网格与混响条件且原文未给出可复述的逐点数值。

 · 更新于 2026-09-24 · 约 21 分钟 · 10084 字 阅读 →
论文解读

A DDSP Framework for Adaptive Room Equalization

自适应滤波 | 6.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6448 字 阅读 →
论文解读

Universal adaptive beamforming: A Bayesian approach

自适应滤波 | 8/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4015 字 阅读 →
论文解读

In-the-Loop Training of Deep Feedback Cancellation for Hearing Aids

自适应滤波 | 5.3/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4222 字 阅读 →
论文解读

Time Segmented Beamforming via Dynamic Programming: Theory and Implementation

自适应滤波 | 8/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6669 字 阅读 →