论文解读

Disentangling Physiology from Fidelity: Latent-Guided Diffusion Models for Cross-Modal Cardiac Synthesis

音频生成 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5351 字 阅读 →
论文解读

Mambaformer: State-Space Augmented Self-Attention with Downup Sampling for Monaural Speech Enhancement

语音增强 | 7.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4866 字 阅读 →
论文解读

Neuromamba: Adaptive Frequency Filtering with a Pyramid Mamba for sEEG-driven Speech Synthesis

语音合成 | 8.0/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5962 字 阅读 →
论文解读

Respire-Mamba C-UNet: Consistency-Trained Autoencoder for High-Fidelity Respiratory Sound Compression

音频压缩 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4022 字 阅读 →
论文解读

Spring Reverb Emulation with Hybrid Gated Convolutional Networks and State Space Models

音频生成 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5227 字 阅读 →
论文解读

Tri-Attention Fusion: Joint Temporal-Spectral and Bidirectional Modeling for Speech Spoofing Detection

语音伪造检测 | 7.0/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5146 字 阅读 →
论文解读

HCFD: A Benchmark for Audio Deepfake Detection in Healthcare

本文针对医疗健康领域中神经音频编解码器生成的语音深伪检测问题,提出了一个全新的研究任务(HCFD)和基准数据集(HCFK)。研究发现,在健康语音上训练的现有深伪检测模型在病态语音上性能显著下降。为此,论文首先验证了预训练音频模型(如PaSST)能更好地应对病理语音带来的变异性。更重要的是,本文提出了

 · 更新于 2026-09-24 · 约 9 分钟 · 4457 字 阅读 →