论文解读

从人脸二分类到十一场景四层追问:AVFakeBench 如何考住音视频大模型

该研究针对真实世界音视频伪造超越人脸、混用编辑与合成的问题,构建含 3000 片段与 12000 问答的 AVFakeBench 并评测 11 个音视频大模型与 2 个专用检测器,报告显示大模型在二分类上更稳但在细粒度分类与解释上大幅下滑且存在视觉偏向与编辑盲区。

 · 更新于 2026-09-24 · 约 18 分钟 · 8895 字 阅读 →
每日研究速递

cvpr-2026 论文深度解读

共收录 103 篇 cvpr-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 212 分钟 · 106059 字 阅读 →
论文解读

只给整段真假标签,如何找回伪造片段的起止时间

问题是弱监督时间伪造定位中训练只做整段二分类而推理要输出边界,方法选择两阶段分类回归加隐属性分解与时序图精炼,最强证据是在两个基准上平均 mAP 分别提升约 8% 和 4%,代价是定位阶段引入约 45M 回归参数与伪标签噪声管理。

 · 更新于 2026-09-24 · 约 20 分钟 · 9981 字 阅读 →
每日研究速递

aaai-2026 论文深度解读

共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 307 分钟 · 153423 字 阅读 →
论文解读

可变形状态空间如何盯住稀疏而模糊的伪造边界

针对音视频时间伪造定位中边界模糊、伪造稀疏和长距离衰减问题,DeformTrace 用可变形自扫描、中继令牌与可变形交叉扫描改造状态空间模型,在 LAV-DF 与 AV-Deepfake1M 上取得精度与效率优势,但依赖冻结特征与固定超参数组合。

 · 更新于 2026-09-24 · 约 17 分钟 · 8507 字 阅读 →
论文解读

真假混在一起时:让大模型先分轨再判真伪的 ToolDF

针对一段音频里同时含真实与伪造、跨时间与跨声源的混合真实性检测,ToolDF 用音频大模型做编排器按结构调用分离与四个领域专家并执行早失败汇总,在复合类型上取得最高的 C-Avg. 81.89,代价是依赖外部工具的可靠性。

 · 更新于 2026-09-24 · 约 15 分钟 · 7181 字 阅读 →
论文解读

类型未知时如何判真假:用两套耳朵听同一段音频

音频伪造检测 | 6.3/10

 · 更新于 2026-09-24 · 约 24 分钟 · 11814 字 阅读 →
论文解读

别只听响度:为什么 AI 炸点声会在“尾巴”里露馅

音频伪造检测 | 5.8/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8682 字 阅读 →
论文解读

On the Robustness of Audio Deepfake Detection under Audio Watermarking

音频伪造检测 | 7.7/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5950 字 阅读 →
论文解读

AT-ADD: A Benchmark and Challenge for Robust and All-Type Audio Deepfake Detection

音频伪造检测 | 9.6/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5822 字 阅读 →
论文解读

Distinguishing AI-Generated Music from Edited Audio as a Hard-Negative Robustness Task

音频伪造检测 | 5.6/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7071 字 阅读 →
论文解读

AT-ADD: All-Type Audio Deepfake Detection Challenge Summary

音频伪造检测 | 6.3/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7256 字 阅读 →
论文解读

Assessing AI-generated music detection in real-world broadcast monitoring

音频伪造检测 | 6.8/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6180 字 阅读 →
论文解读

How Much AI Is in This Track? Quantifying the Proportion of AI-Generated Stems in Hybrid Music Mixtures

音频伪造检测 | 8.3/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6888 字 阅读 →
论文解读

Multi-Backbone Self-Supervised Ensembles for Audio Deepfake Detection and a Cross-Track Analysis of Generation-Detection Asymmetry

音频伪造检测 | 7.2/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6916 字 阅读 →
论文解读

Improved Robustness in AI-Generated Music Detection

音频伪造检测 | 8.0/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7579 字 阅读 →
论文解读

Less is More: Modality-Decoupling for General AIGC Audio-Video Detection

音频伪造检测 | 7.5/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7402 字 阅读 →
论文解读

ThinkOmni: A Reasoning-Driven Omni-Modal LLM Framework for Audio Forgery Detection and Localization

音频伪造检测 | 8.3/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7713 字 阅读 →
论文解读

Audio Cross Verification Using Dual Alignment Likelihood Ratio Test

音频伪造检测 | 6.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6313 字 阅读 →
论文解读

Component-Level Ensemble Fusion for Speech and Environmental Sound Deepfake Detection

语音伪造检测 | 6.4/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6832 字 阅读 →