每日研究速递

eacl-2026 论文深度解读

共收录 36 篇 eacl-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 75 分钟 · 37568 字 阅读 →
论文解读

先对齐再推理:ConLLM 用两阶段解决模态割裂与浅层融合

针对多模态伪造中模态割裂与跨模态语义推理不足的问题,ConLLM 采用预训练模型分模态抽取加对比对齐与类 GPT 变换器精炼的两阶段结构,在音频、视频与音视频六个基准上报告了更低的等错误率与更高的准确率,但其增益依赖预训练权重与训练数据覆盖且推理代价仍需权衡。

 · 更新于 2026-09-24 · 约 18 分钟 · 8868 字 阅读 →
论文解读

同域满分、跨域随机:XMAD-Bench 逼出音频伪造检测的泛化缺口

论文以 7 语种 668.8 小时配对语料构造说话人、生成方法和真实源三重隔离的跨域评测,报告同域准确率常达 100% 而跨域大幅跌落甚至近随机,最强的 wav2vec 2.0 与 Whisper+MLP 也只在部分语言保持可用,代价是生成方法随语言不同且需持续更新。

 · 更新于 2026-09-24 · 约 18 分钟 · 8590 字 阅读 →
论文解读

整段对话只换一句话:冻结检测器如何给出伪造时间戳

论文把多说话人对话中的手术式伪造注入形式化为时序定位问题,用冻结二分类器加滑窗与迟滞解码器实现零样本定位,在 180 段构造对话上以强骨干达到时序交并比 0.90 左右,但边界位移约 3.5 秒且短时域外生成器注入仍接近全漏检。

 · 更新于 2026-09-24 · 约 16 分钟 · 7725 字 阅读 →
论文解读

并行解耦全局与局部:E-Branchformer 在音频伪造检测中的可复述设计

针对语音伪造检测中自监督表示难以同时捕捉长程与短程线索的问题,论文用并行全局注意力与局部卷积分支加解耦类令牌与 DWConv-SE 融合的 E-Branchformer,在 ASVspoof 2021 LA/DF 与 ITW 上取得 0.88%/1.85%/6.30% EER 并在 ASVspoof 5 上取得 5.44% EER,代价是四层编码器与细粒度融 …

 · 更新于 2026-09-24 · 约 16 分钟 · 7822 字 阅读 →
论文解读

分数之外保留证据:可审计决策记录如何改进语音伪造检测的复核

在 ASVspoof 5 Track 1 的 4,080 条匹配子集上,用被动分数、键控探针、检索与说话人轮廓四路证据组成可审计记录并做晚期校准,使检索增强的固定融合从 15.84% 降至 11.91% EER、校准后达 8.43% EER 并在 33.75% 复核预算下覆盖 82.85% 错误,但最强被动 WavLM 仍为 6.71% EER。

 · 更新于 2026-09-24 · 约 20 分钟 · 9747 字 阅读 →
论文解读

用可学习的分组有理激活替换固定激活:KanAdapter 在语音基座模型上的并行瓶颈适配

针对全量微调语音自监督基座模型代价高、MLP 适配器表达受限的问题,KanAdapter 以并行瓶颈中的 GR-KAN 可学习有理激活替换固定激活,在说话人验证、情感识别与伪造检测上以减少 94.7% 至 97.5% 可训练参数接近全量微调,并在两阶段持续学习上相对全量微调降低 83.6% 错误率。

 · 更新于 2026-09-24 · 约 21 分钟 · 10098 字 阅读 →
论文解读

BanglaFake: Constructing and Evaluating a Specialized Bengali Deepfake Audio Dataset

音频深度伪造检测 | 9/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4225 字 阅读 →
论文解读

Robust Spoofed Speech Detection via Temporal Pyramid Modeling

音频深度伪造检测 | 6.7/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6597 字 阅读 →
论文解读

Dual-Branch Gated Fusion for Open-Set Audio Deepfake Source Tracing

音频深度伪造检测 | 7.8/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6305 字 阅读 →
论文解读

Audio Deepfake Detection with Half-Truth Localisation Using Cross-Attentive Feature Fusion

音频深度伪造检测 | 8.4/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5324 字 阅读 →
论文解读

MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio

音频深度伪造检测 | 10/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7102 字 阅读 →
论文解读

EMO-BOOST: Emotion-Augmented Audio-Visual Features for Improved Generalization in Deepfake Detection

音频深度伪造检测 | 7.2/10

 · 更新于 2026-09-24 · 约 17 分钟 · 8115 字 阅读 →
论文解读

EnvTriCascade: An Environment-Aware Tri-Stage Cascaded Framework for ESDD2 2026 Challenge

音频深度伪造检测 | 5.3/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9344 字 阅读 →
论文解读

MusicDET: Zero-Shot AI-Generated Music Detection

音频深度伪造检测 | 7.4/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7396 字 阅读 →
论文解读

The Deepfakes We Missed: We Built Detectors for a Threat That Didn't Arrive

深度伪造检测 | 6.5/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7431 字 阅读 →
论文解读

RADAR Challenge 2026: Robust Audio Deepfake Recognition under Media Transformations

音频深度伪造检测 | 6.0/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7522 字 阅读 →
论文解读

Towards Trustworthy Audio Deepfake Detection: A Systematic Framework for Diagnosing and Mitigating Gender Bias

音频深度伪造检测 | 6.5/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8536 字 阅读 →
论文解读

Quantum Kernels for Audio Deepfake Detection Using Spectrogram Patch Features

音频深度伪造检测 | 6.5/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7805 字 阅读 →
论文解读

Beyond Seeing Is Believing: On Crowdsourced Detection of Audiovisual Deepfakes

音频深度伪造检测 | 7.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4636 字 阅读 →