论文解读

Your U-Net Dereverberation Model is Secretly an RIR Encoder

对比学习 | 8.3/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4101 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-06-09

共分析 48 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 141 分钟 · 70154 字 阅读 →
论文解读

Bridging the Front-End and Back-End for Robust ASR via Cross-Attention-Based U-Net

语音识别 | 7.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4857 字 阅读 →
论文解读

Diff-vs: Efficient Audio-Aware Diffusion U-Net for Vocals Separation

语音分离 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4668 字 阅读 →
论文解读

FUN-SSL: Full-Band Layer Followed by U-Net With Narrow-Band Layers for Multiple Moving Sound Source Localization

声源定位 | 8.0/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3953 字 阅读 →
论文解读

TVP-UNet: Threshold Variance Penalty U-Net for Voice Activity Detection in Dysarthric Speech

语音活动检测 | 7.0/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3256 字 阅读 →
论文解读

ArtifactNet: Detecting AI-Generated Music via Forensic Residual Physics

这篇论文旨在解决AI生成音乐检测中普遍存在的泛化能力差的问题。当前主流方法(如CLAM、SpecTTTra)通过学习AI音乐的声音特征,在面对未见过的生成器时性能急剧下降。作者提出了一个核心假设:当前主流AI音乐生成器(如Suno, Udio)都依赖神经音频编解码器(如EnCodec)的残差矢量量化

 · 更新于 2026-09-24 · 约 10 分钟 · 4777 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-21

共分析 34 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 73 分钟 · 36177 字 阅读 →