论文解读

Multimodal Co-Training with Subtractive Unlabeled-Benefit Bounds

多模态学习 | 6.0/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3241 字 阅读 →
论文解读

Teaching the Teachers: Boosting Unsupervised Domain Adaptation In Speech Recognition By Ensemble Update

语音识别 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4428 字 阅读 →
论文解读

TVP-UNet: Threshold Variance Penalty U-Net for Voice Activity Detection in Dysarthric Speech

语音活动检测 | 7.0/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3256 字 阅读 →
论文解读

StreamMark: A Deep Learning-Based Semi-Fragile Audio Watermarking for Proactive Deepfake Detection

本文针对生成式AI带来的音频深度伪造威胁,提出了一种名为StreamMark的主动防御框架。该框架是一种基于深度学习的半脆弱音频水印系统,其核心创新在于重新定义了水印的目标:不是追求对所有变换的绝对鲁

 · 更新于 2026-09-24 · 约 9 分钟 · 4375 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-19

共分析 42 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 94 分钟 · 46668 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-18

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 276 分钟 · 137848 字 阅读 →