论文解读

Distinguishing AI-Generated Music from Edited Audio as a Hard-Negative Robustness Task

音频伪造检测 | 5.6/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7071 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-18

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 129 分钟 · 64264 字 阅读 →
论文解读

CardioState-JEPA: Delay-Aware Cross-Modal Learning of a Shared Cardiac Representation

音频分类 | 7.2/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8815 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-14

共分析 12 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 36 分钟 · 17828 字 阅读 →
论文解读

Robust Multi-Tier Infant-Centered Audio Understanding with Whisper via Structured Speaker Conditioning

音频事件检测 | 6.0/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5766 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-13

共分析 18 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 56 分钟 · 27887 字 阅读 →
论文解读

A Dataset and Benchmark for Optical Music Recognition of String Quartet Scores

端到端 | 8.5/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7765 字 阅读 →
论文解读

BiTSE: Binaural Target Speaker Extraction in Noisy Multi-Talker Environments for AR Glass Arrays

语音分离 | 5.0/10

 · 更新于 2026-09-24 · 约 20 分钟 · 9824 字 阅读 →
论文解读

DINO-A: Adapting Self-Distillation Vision Transformers to General Audio Representation Learning

音频分类 | 6.2/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7322 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-12

共分析 27 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 76 分钟 · 37591 字 阅读 →
论文解读

Physics-Informed Learning for Robust Acoustic Localization with Calibrated Uncertainty

声源定位 | 6.2/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6273 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-11

共分析 40 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 114 分钟 · 56810 字 阅读 →
论文解读

Multi Codec Discrete Diffusion Model for Text Guided Speech Inpainting and Editing

语音编辑 | 7.3/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6259 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-10

共分析 16 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 45 分钟 · 22351 字 阅读 →
论文解读

Audio-to-Score Transcription using Pre-trained Features, Data Augmentation, and the New SheetSage-A2S Dataset

音乐转录 | 7.7/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5987 字 阅读 →
论文解读

Beyond Residual Connections: Manifold-Constrained Hyper-Connections for Robust Speaker Representation Learning

说话人验证 | 6.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4473 字 阅读 →
论文解读

Bias Analysis of L2 Speaking Assessment Systems Using Concept Activation Vectors

语音质量评估 | 6.7/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7166 字 阅读 →
论文解读

Decolonizing Linguistic Policies in Automated Speech Recognition: A Framework for Cross-Culturally Competent Speech AI

语音识别 | 7.8/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3465 字 阅读 →
论文解读

EG-VAE: A Unified Framework for Electric Guitar Tone Transfer and Removal

音频生成 | 7.3/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7237 字 阅读 →
论文解读

Explicit and Stable Pseudospectral Time-Domain Method for the Föppl-von Kármán Equations

音频理解 | 7.2/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6256 字 阅读 →