语音/音乐/音频论文速递 2026-08-17 共分析 20 篇论文
⚡ 今日概览 📥 抓取 20 篇 → 🔬 深度分析完成
🏷️ 热门方向 方向 数量 分布 #音乐理解 3篇 ███ #语音合成 2篇 ██ #语音识别 2篇 ██ #音视频生成 2篇 ██ #语音交互 1篇 █ #语音伪造检测 1篇 █ #说话人日志 1篇 █ #音乐源分离 1篇 █ 📊 论文评分排行榜(20 篇,按分数降序) 排名 论文 总分 分档 文档类型 主任务 🥇 VoiceChat-TTS: A Low-Latency Continuous Speech Synthesi 8.2分 前25% 模型报告 #语音合成 🥈 Omni-LiveAvatar: Minute-Level Real-Time Streaming Joint 7.7分 前25% 方法研究 #音视频生成 🥉 Trajectory Dynamics in Self-Supervised Learning Latent 7.6分 前25% 方法研究 #语音伪造检测 4. H2H Music Improv: A Communication Model and Audio-Visua 7.6分 前25% 数据集与基准 #音乐理解 5. Singer-Informed Vocal Source Separation for Multi-Singe 7.5分 前25% 方法研究 #音乐源分离 6. Why Performance Metrics Overpromise in Auditory Attenti 6.9分 前50% 方法研究 #语音交互 7. VoiceDesigner: Text-to-Voice Generation and Editing via 6.8分 前50% 系统技术报告 #语音合成 8. The MPB Corpus: A Dataset of Melody, Rhythm, Harmony, a 6.8分 前50% 数据集与基准 #音乐理解 9. Acoustic UAV Detection in Battlefield Scenarios: Handli 6.7分 前50% 方法研究 #音频事件检测 10. Avatar-Forever: Decoupled Parallel Training for High-Qu 6.6分 前50% 方法研究 #音视频生成 11. LoopVSR: A Loop Engineering Framework for Automated Rep 6.6分 前50% 方法研究 #音视频语音识别 12. Leading-Silence Augmentation and Multi-Stage Synthetic 6.5分 前50% 系统技术报告 #说话人日志 13. StreamHear: Domain-Adapted Pseudo-Labeling for Semi-Sup 6.4分 前50% 方法研究 #语音识别 14. Ambisonics Encoding of Room Impulse Responses using a D 6.3分 前50% 方法研究 #音频生成 15. AT-ADD: All-Type Audio Deepfake Detection Challenge Sum 6.3分 前50% 数据集与基准 #音频伪造检测 16. S2Dialog: Multimodal Dialogue Retrieval with Semantic a 6.0分 前50% 方法研究 #音频检索 17. Measuring Fairness in Large Audio Language Models via S 5.6分 前50% 方法研究 #语音识别 18. Exploring ESC Winners with Nested Diagrams 5.4分 后50% 系统技术报告 #音乐理解 19. Architecture and Affordances of PLAUD: Performative Lat 5.0分 后50% 系统技术报告 #音乐生成 20. Sensor-Driven Mission Synthesis for UAV/UGV Swarms: A T 4.4分 后50% 系统技术报告 #音视频理解 📋 论文列表 🥇 VoiceChat-TTS: A Low-Latency Continuous Speech Synthesis Model for Interactive Agents 8.2/10 | 创新 1.1/2 | 严谨 1.2/1.5 | 实验 1/1.5 | 清晰 0.8/1 | 影响 1/1.5 | 开源 1.5/1.5 | 复现 0.3/0.5 | 工程 1.3/1.5
...