论文解读

溯源不是抗失真:用密钥与宿主绑定重做语音水印

KeyBound 把 16 比特载荷先用密钥掩码再经宿主频谱调制嵌入,以存在检测与密钥解码分离的验证规则做归属,在谱去噪下保持检测 1.00 与比特精度 0.98,代价是宽带感知质量降到 3.03 且自适应重构移除仍能抹掉水印。

 · 约 21 分钟 · 10280 字 阅读 →
论文解读

把水印藏进编解码器保留的潜变量方向:DeltaMark 对神经编解码重合成的鲁棒性

针对波形水印经神经编解码重合成后易失效的问题,论文用冻结 EnCodec 连续潜变量上的前馈加性扰动做 16 比特水印,在重复与低码率 EnCodec 重合成下退化更平缓,但端到端音质受限于编解码器载体本身。

 · 约 20 分钟 · 9672 字 阅读 →
论文解读

把水印藏进编码器能保住的结构:NeuMark 对神经编解码器重合成的应对

针对神经编解码器重合成会抹掉波形域水印的问题,NeuMark 把 16 比特消息分布嵌入 SpeechTokenizer 的 8 路残差量化潜变量并用失真增强训练检测与解码,其代价是潜变量方法的透明度受限于编解码器自身重建质量并需区分原始参考与重建参考。

 · 约 21 分钟 · 10520 字 阅读 →
论文解读

不靠攻击仿真堆料:用对抗嵌入与时间无关读出做音频水印

针对剪切拼接易失同步的问题,AWARE 用时频域对抗优化嵌入水印并以时间无关检测器解码,在保持 PESQ 约 4.26 与 STOI 约 0.99 的同时在多种编辑下保持低误码率,代价是逐样本迭代嵌入开销与神经压缩等条件仍有残留误差。

 · 更新于 2026-09-24 · 约 17 分钟 · 8149 字 阅读 →
每日研究速递

eusipco-2026 论文深度解读

共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 247 分钟 · 123292 字 阅读 →
每日研究速递

aaai-2026 论文深度解读

共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 307 分钟 · 153423 字 阅读 →
论文解读

在各向异性主成分平面里小角度旋转:无须训练的盲语音水印

针对生成语音溯源需要的盲检测水印问题,论文选择在预训练编解码器隐空间做密钥控制的正交小旋转,最强证据是跨数据集干净条件下正确密钥可检而错误密钥回到随机猜测,主要代价是高通滤波下检测下降且仅做客观质量估计。

 · 更新于 2026-09-24 · 约 20 分钟 · 9845 字 阅读 →
每日研究速递

odyssey-2026 论文深度解读

共收录 52 篇 odyssey-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 108 分钟 · 53865 字 阅读 →
论文解读

把水印藏进起始噪声:锚定反演如何找回被波形转换打乱的归属

针对潜扩散文本生成音频的归属问题,该文把水印映射为初始隐向量这一支点锚,用无引导扩散生成锚序列并以软动态时间规整优化反演轨迹,在保持生成流程不变下报告了更强的鲁棒性,但每步多轮优化带来了可观的提取时间代价。

 · 更新于 2026-09-24 · 约 18 分钟 · 8615 字 阅读 →
论文解读

把关键词藏起来还能无损找回来:IO-RAE 的可逆混淆

针对语音被人和自动语音识别系统窃听关键词的问题,论文用大语言模型选替换词加累积信号攻击做局部混淆、再用可逆信息隐藏嵌入扰动,在 LibriSpeech 上报告目标误导率 96.5% 与恢复音频 PESQ 4.45,代价是强扰动与可逆嵌入的存储开销和对齐依赖。

 · 更新于 2026-09-24 · 约 19 分钟 · 9092 字 阅读 →
论文解读

再嵌入一次就换主人:神经音频水印为何挡不住覆盖攻击

论文把音频水印威胁从删除与伪造推进到再嵌入伪造消息并劫持归属的覆盖攻击,在 AudioSeal、Timbre、WavMark 上按白盒、灰盒、黑盒验证了接近 100% 的原水印失效率,代价是暴力堆叠会让信噪比明显下降而查询筛选能省下一半以上训练开销。

 · 更新于 2026-09-24 · 约 19 分钟 · 9480 字 阅读 →
论文解读

加了编解码器训练就掉音质:CRAW 用注意力、掩蔽与纠错把两者拉回平衡

CRAW 针对神经编解码器与去噪重合成导致后处理水印失效的问题,用加宽失真训练加注意力池化加推理时感知掩蔽加重复纠错码,在保持 PESQ 约 4.0 的同时把编解码器与去噪下的检测 F1 拉回 0.8 以上,代价是掩蔽带来约 150 ms 的额外推理延迟。

 · 更新于 2026-09-24 · 约 19 分钟 · 9217 字 阅读 →
论文解读

别让检测器猜伪迹:先把原声的压缩记忆藏回去

语音伪造检测 | 6.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5792 字 阅读 →
论文解读

想找回被替换的原话,先接受水印不能再像哈希那样精确

音频水印 | 6.4/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3888 字 阅读 →
论文解读

On the Robustness of Audio Deepfake Detection under Audio Watermarking

音频伪造检测 | 7.7/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5950 字 阅读 →
论文解读

AudioNoisePrints: Model-free audio watermarking using spatial correlation in flow matching TTS

音频水印 | 7.9/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4737 字 阅读 →
论文解读

How Fragile Is Your Watermark? Training-Free Structural Removal of Neural Audio Watermarks

音频水印 | 7.6/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7533 字 阅读 →
论文解读

Investigating Codec-Internal Latent Audio Watermarking for Neural Codec Robustness

音频水印 | 6.4/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7234 字 阅读 →
论文解读

SSTMark: Robust Training-Free Semantic-Level Speech Watermarking

音频水印 | 6.5/10

 · 更新于 2026-09-24 · 约 21 分钟 · 10235 字 阅读 →
论文解读

MusicMark: A Robust Generative Watermarking Framework for Music Generation

音频水印 | 7.3/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8863 字 阅读 →