论文解读

缺口比模型阶数还短时,Etter 的双向自回归插值还能解吗

论文复活 Etter 双向自回归插值,用前后向预测残差能量最小导出线性方程组求缺口样本,并给出短缺口高阶模型和因果丢包隐藏两种扩展,在 80 毫秒内音乐缺口上与多数基线相当但弱于逐缺口 Janssen 迭代法且外插简化版更快。

 · 更新于 2026-09-24 · 约 18 分钟 · 8983 字 阅读 →
论文解读

时变房间里用音乐做激励:可微分参数均衡为何要换掉时域误差

论文把自适应房间均衡做成闭环可微分控制,用 7 段参量均衡加频域误差在实测时变房间脉冲响应和音乐激励下跟踪目标响应,最强证据是频域目标相对未均衡把系统距离压低约 7 成而时域误差全配置不收敛,代价是对在线房间估计质量敏感且高阶优化器单帧耗时接近帧长。

 · 更新于 2026-09-24 · 约 24 分钟 · 11623 字 阅读 →
论文解读

从噪声中途上车:暖初始化让同一个扩散模型做音色迁移与音频修复

论文用暖初始化把预训练音频扩散模型的逆向过程从引导信号中途启动,以双簧管转钢琴等实验研究初始化时间与噪声比例的取舍,报告在杰卡德距离低于 0.6 且弗雷歇音频距离低于 0.7 附近存在可用工作点,代价是对人声与强打击乐等成分处理不稳定且依赖高引导强度等超参数。

 · 更新于 2026-09-24 · 约 21 分钟 · 10477 字 阅读 →
论文解读

场景决定何为噪声:自动上下文去噪如何先判场景再去异物

该文把去噪目标改为随声场景变化的界内与界外事件,用先做声场景分类再做条件掩蔽去噪的两阶段网络,在六类场景配对数据上以可运行的 UNet 为基线对比,学习到的上下文取得最高 SI-SDR 但合成混合的统计失配仍是主要代价。

 · 更新于 2026-09-24 · 约 20 分钟 · 9951 字 阅读 →
每日研究速递

cvpr-2026 论文深度解读

共收录 103 篇 cvpr-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 212 分钟 · 106059 字 阅读 →
每日研究速递

dafx-2026 论文深度解读

共收录 91 篇 dafx-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 181 分钟 · 90282 字 阅读 →
论文解读

肺音没有干净配对时如何去噪:复数时频 U-Net 的分层合成与相位重建路线

该研究把单通道肺音去噪定义为从心音、摩擦与环境噪声叠加中恢复胸壁肺音,用可微短时傅里叶变换包裹的复数谱残差 U-Net 做端到端估计,在合成与真实混合上报告了更高的信噪比改善和更低的重建误差,但高信噪比段的失真风险与临床保真仍待单独验证。

 · 更新于 2026-09-24 · 约 17 分钟 · 8357 字 阅读 →
论文解读

用电刺激逼近正常听觉神经响应:闭环耳蜗植入框架的概念验证

该研究把正常听觉与电刺激听觉都写成可微模型,用同一段语音驱动两条通路并以螺旋神经节神经元包络误差为目标训练双网络刺激器,在 TIMIT 干净语音上把包络平均绝对误差从 0.6261 降到 0.0934,代价是仅用单一包络指标、干净语音和 8 kHz 以下频带且允许同时刺激。

 · 更新于 2026-09-24 · 约 17 分钟 · 8245 字 阅读 →
每日研究速递

eusipco-2026 论文深度解读

共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 247 分钟 · 123292 字 阅读 →
论文解读

鼓面共振强、单点信噪比低:用模态把多点双轴散斑位移对齐后再反推声音

针对固体共振物体声音恢复弱且染色重的问题,该工作用模态形状梯度与二阶模态传递函数建立多点双轴散斑位移到声源的前向模型并做正则优化反演,在鼓等多物体上比单点、平均与固定延迟融合更干净,但高频模态漏检仍是主要代价。

 · 更新于 2026-09-24 · 约 20 分钟 · 10016 字 阅读 →
论文解读

线性插值是瓶颈:用拉格朗日插值加切比雪夫逼近重做抗混叠积分

论文把抗导数抗混叠首步的线性插值换成二三阶拉格朗日插值,并用切比雪夫多项式逼近非线性使矩形与三角核积分可闭式计算,在 3192 Hz 正弦加 tanh 与硬削波实验中显著提升信噪比,代价是每样本多次非线性求值与离散余弦变换开销。

 · 更新于 2026-09-24 · 约 18 分钟 · 8620 字 阅读 →
每日研究速递

aaai-2026 论文深度解读

共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 307 分钟 · 153423 字 阅读 →
论文解读

以多指标一致偏好约束生成式语音修复:GenSR-Pref 与三范式 DPO 对齐

针对生成式语音修复中似然目标与听感偏好错位及单指标奖励作弊问题,论文用四维一致投票构造约 8 万偏好对并做 DPO 对齐,在 AR、掩码生成与流匹配三范式上报告了一致的客观与主观增益,代价是依赖自动指标代理与同范式数据更有效。

 · 更新于 2026-09-24 · 约 19 分钟 · 9309 字 阅读 →
论文解读

LipsAM: Lipschitz-continuous Neural Networks for Convergent Plug-and-Play Audio Signal Recovery

音频修复 | 10.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4404 字 阅读 →
论文解读

Multi Codec Discrete Diffusion Model for Text Guided Speech Inpainting and Editing

语音编辑 | 7.3/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6259 字 阅读 →
论文解读

Music Restoration via Latent Operator Optimization and Diffusion Model Priors

音频修复 | 7.0/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6911 字 阅读 →
论文解读

Listening Through the Noise: Cauchy-Driven Diffusion Bridges for Robust Gastrointestinal Auscultation and Clinical Benchmarking

音频修复 | 7.4/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8704 字 阅读 →
论文解读

SonicMaster: Towards Controllable All-in-One Music Restoration and Mastering

音频修复 | 8/10

 · 更新于 2026-09-24 · 约 17 分钟 · 8353 字 阅读 →
论文解读

A Survey of Advancing Audio Super-Resolution and Bandwidth Extension from Discriminative to Generative Models

音频修复 | 8.1/10

 · 更新于 2026-09-24 · 约 17 分钟 · 8138 字 阅读 →
论文解读

Real-time Speech Restoration using Data Prediction Mean Flows

音频修复 | 7.5/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7597 字 阅读 →