论文解读

CMSA-Mamba: Hierarchical State Space Modeling for Audio-Based Depression Detection

语音生物标志物 | 7.0/10

 · 更新于 2026-09-11 · 约 9 分钟 · 4290 字 阅读 →
论文解读

Co-Initialization of Control Filter and Secondary Path via Meta-Learning for Active Noise Control

音频安全 | 7.5/10

 · 更新于 2026-09-11 · 约 11 分钟 · 5076 字 阅读 →
论文解读

CodecSlime: Temporal Redundancy Compression of Neural Speech Codec via Dynamic Frame Rate

语音编码 | 7.5/10

 · 更新于 2026-09-11 · 约 12 分钟 · 5581 字 阅读 →
论文解读

CodeSep: Low-Bitrate Codec-Driven Speech Separation with Base-Token Disentanglement and Auxiliary-Token Serial Prediction

语音分离 | 7.5/10

 · 更新于 2026-09-11 · 约 13 分钟 · 6108 字 阅读 →
论文解读

Combining Multi-Order Attention and Multi-Resolution Discriminator for High-Fidelity Neural Vocoder

语音合成 | 6.5/10

 · 更新于 2026-09-11 · 约 13 分钟 · 6236 字 阅读 →
论文解读

Combining SSL Speech Features, Contextual Transformers and Mamba Models for Realistic Audio Spoofing Detection

音频深度伪造检测 | 7.5/10

 · 更新于 2026-09-11 · 约 9 分钟 · 4304 字 阅读 →
论文解读

Compression meets Sampling: LZ78-SPA for Efficient Symbolic Music Generation

音乐生成 | 7.5/10

 · 更新于 2026-09-11 · 约 12 分钟 · 5902 字 阅读 →
论文解读

CompSpoof: A Dataset and Joint Learning Framework for Component-Level Audio Anti-Spoofing Countermeasures

音频深度伪造检测 | 7.0/10

 · 更新于 2026-09-11 · 约 11 分钟 · 5184 字 阅读 →
论文解读

Condition-Invariant fMRI decoding of speech intelligibility with deep state space model

神经解码 | 7.0/10

 · 更新于 2026-09-11 · 约 9 分钟 · 4075 字 阅读 →
论文解读

Conditional Diffusion Models for Mental Health-Preserving Voice Conversion

语音转换 | 8.0/10

 · 更新于 2026-09-11 · 约 10 分钟 · 4927 字 阅读 →
论文解读

Confidence-Based Filtering for Speech Dataset Curation with Generative Speech Enhancement Using Discrete Tokens

语音增强 | 6.5/10

 · 更新于 2026-09-11 · 约 10 分钟 · 4790 字 阅读 →
论文解读

Confidence-Guided Error Correction for Disordered Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-11 · 约 10 分钟 · 4863 字 阅读 →
论文解读

Connecting Layer-Wise Representation of Wavlm with Spectro-Temporal Modulation on Speaker Verification

说话人验证 | 6.0/10

 · 更新于 2026-09-11 · 约 9 分钟 · 4366 字 阅读 →
论文解读

Constraint Optimized Multichannel Mixer-Limiter Design

多通道 | 7.0/10

 · 更新于 2026-09-11 · 约 10 分钟 · 4564 字 阅读 →
论文解读

Constructing Composite Features for Interpretable Music-Tagging

音乐信息检索 | 7.5/10

 · 更新于 2026-09-11 · 约 9 分钟 · 4319 字 阅读 →
论文解读

Content Anonymization for Privacy in Long-Form Audio

语音匿名化 | 7.5/10

 · 更新于 2026-09-11 · 约 10 分钟 · 4691 字 阅读 →
论文解读

Content Leakage in Librispeech and its Impact on the Privacy Evaluation of Speaker Anonymization

语音匿名化 | 7.5/10

 · 更新于 2026-09-11 · 约 8 分钟 · 3586 字 阅读 →
论文解读

Content-Preserving Speech Representation Learning Via Adaptive Segment-Level Alignment

语音识别 | 7.5/10

 · 更新于 2026-09-11 · 约 11 分钟 · 5415 字 阅读 →
论文解读

Context-Aware Dynamic Graph Learning for Multimodal Emotion Recognition with Missing Modalities

语音情感识别 | 8.8/10

 · 更新于 2026-09-11 · 约 9 分钟 · 4275 字 阅读 →
论文解读

Contextual Biasing for ASR in Speech LLM with Common Word Cues and Bias Word Position Prediction

语音识别 | 7.0/10

 · 更新于 2026-09-11 · 约 11 分钟 · 5305 字 阅读 →