论文解读

Do Foundational Audio Encoders Understand Music Structure?

音乐信息检索 | 7.0/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3755 字 阅读 →
论文解读

Does the Pre-Training of an Embedding Influence its Encoding of Age?

语音生物标志物 | 7.0/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3128 字 阅读 →
论文解读

Influence of Clean Speech Characteristics on Speech Enhancement Performance

语音增强 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4057 字 阅读 →
论文解读

Mind Your [m]S, Cross Your [t]S: a Large-Scale Phonetic Analysis of Speech Reproduction in Modern Speech Generators

语音伪造检测 | 7.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4597 字 阅读 →
论文解读

Modeling Strategies For Speech Enhancement in The Latent Space of a Neural Audio Codec

语音增强 | 8.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4963 字 阅读 →
论文解读

Off-The-Grid Multi-Pitch Estimation Using Optimal Transport

音乐信息检索 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4885 字 阅读 →
论文解读

S-PRESSO: Ultra Low Bitrate Sound Effect Compression with Diffusion Autoencoders and Offline Quantization

音频生成 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5113 字 阅读 →
论文解读

Scaling Spoken Language Models with Syllabic Speech Tokenization

语音理解 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4144 字 阅读 →
论文解读

Towards Real-Time Generative Speech Restoration with Flow-Matching

语音增强 | 6.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4390 字 阅读 →