每日研究速递

语音/音乐/音频论文速递 2026-09-01

共分析 49 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 151 分钟 · 75584 字 阅读 →
论文解读

Fourier is Frontier: Frequency-Aware Autoencoding for High-Fidelity Music Reconstruction

音乐生成 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5015 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-21

共分析 18 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 60 分钟 · 29950 字 阅读 →
论文解读

Contrastive Learning with Variational Regularization for Multi-Session EEG-to-Speech Decoding

语音合成 | 5.9/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6339 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-18

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 129 分钟 · 64264 字 阅读 →
论文解读

Architecture and Affordances of PLAUD: Performative Latents and Unsupervised DDSP

音乐生成 | 5.0/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6931 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-17

共分析 20 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 62 分钟 · 30965 字 阅读 →
论文解读

Pitch Contour Tokenization using VQ-VAE and Its Application on Korean Traditional Music Analysis

音乐理解 | 7.1/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6409 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-12

共分析 27 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 76 分钟 · 37591 字 阅读 →
论文解读

EG-VAE: A Unified Framework for Electric Guitar Tone Transfer and Removal

音频生成 | 7.3/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7237 字 阅读 →
论文解读

KVAE: Family of Tokenizers for Multimodal Generative Models

音频编码 | 8.1/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7110 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-07

共分析 21 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 57 分钟 · 28125 字 阅读 →
论文解读

MeloCodec: Harnessing Melodic Priors for High-Fidelity Singing Voice Representation

歌唱生成 | 6.1/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6210 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-05

共分析 32 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 93 分钟 · 46258 字 阅读 →
论文解读

Explainable AI through the Lens of Material Agency: Enabling Musical Interface Design with Neural Audio Models

音乐生成 | 6.7/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6159 字 阅读 →
论文解读

OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation

音视频生成 | 7.1/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7731 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-28

共分析 31 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 103 分钟 · 51404 字 阅读 →
论文解读

Structural Bottlenecks on Frequency Representation in End-to-End Audio Models

音频生成 | 7.6/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6425 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-10

共分析 19 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 64 分钟 · 31889 字 阅读 →
论文解读

NouveauVoice: Generating Novel Pseudo Speakers for Voice Anonymization

语音转换 | 5.9/10

 · 更新于 2026-09-24 · 约 5 分钟 · 2033 字 阅读 →