论文解读

MusPyExpress: Extending MusPy with Enhanced Expression Text Support

音乐理解 | 8.7/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5294 字 阅读 →
论文解读

Fourier is Frontier: Frequency-Aware Autoencoding for High-Fidelity Music Reconstruction

音乐生成 | 7.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5015 字 阅读 →
论文解读

MultiVerse: A Creator-Centered Approach to Steering Context-Adaptive Lyrics

音乐生成 | 5.4/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5817 字 阅读 →
论文解读

Why GPT-Style Models Do Not Directly Transfer to Symbolic Music: Compression in the Wrong Coordinate System

音乐生成 | 6.7/10

 · 更新于 2026-09-25 · 约 7 分钟 · 3187 字 阅读 →
论文解读

Architecture and Affordances of PLAUD: Performative Latents and Unsupervised DDSP

音乐生成 | 5.0/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6931 字 阅读 →
论文解读

Drive-to-Music: Context-Aware Generative Audio for In-Vehicle Experiences

音乐生成 | 5.2/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7478 字 阅读 →
论文解读

Dialogue-Aware Video-to-Music Generation Using Public Domain Film Collections

音视频生成 | 7.1/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5281 字 阅读 →
论文解读

Do Text-to-Music Models Really Follow Instructions? A Counterfactual Evaluation of Key and Beat Grouping

音乐生成 | 6.8/10

 · 更新于 2026-09-25 · 约 17 分钟 · 8231 字 阅读 →
论文解读

MuseCritic: Learning Multi-Aspect Song Rewards through Natural-Language Aesthetic Critiques

音频质量评估 | 6.5/10

 · 更新于 2026-09-25 · 约 6 分钟 · 3001 字 阅读 →
论文解读

MAJEPPA: Morphing and Assessing in a Unified Piano Performance Space

音乐理解 | 7.5/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6358 字 阅读 →
论文解读

MazzikaAI: A knowledge-based performance-to-prompt compiler for real-time Arabic maqam accompaniment with a streaming text-to-music model

音乐生成 | 6.6/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7239 字 阅读 →
论文解读

Beyond Reconstruction: Full-Context Generative DiT for Music Generation

音乐生成 | 7.5/10

 · 更新于 2026-09-25 · 约 16 分钟 · 7890 字 阅读 →
论文解读

MusicLayout: Explicit Structural Planning for Controllable Text-to-Music Generation

音乐生成 | 6.3/10

 · 更新于 2026-09-25 · 约 24 分钟 · 11885 字 阅读 →
论文解读

RAG-Audio: Retrieval-Augmented Generation for Faithful Brain-to-Audio Reconstruction

音频生成 | 6.9/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9065 字 阅读 →
论文解读

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation

音频生成 | 7.6/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9341 字 阅读 →
论文解读

VIOLET: High-Fidelity Violin Synthesis with Techniques and Dynamics

音乐生成 | 7.6/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7116 字 阅读 →
论文解读

MI-MIDI: Mechanistic Interpretability of Text-to-MIDI Generation Models via Probing, Lenses and Steering

音乐生成 | 7.1/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6408 字 阅读 →
论文解读

Diff-Symbo: Text-Controlled Long-Duration Symbolic Music Generation Using Autoregressive Latent Diffusion Model

音乐生成 | 6.5/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6469 字 阅读 →
论文解读

Rethinking Automatic Music Mixing as Sequential Stem Blending

音乐生成 | 6.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5496 字 阅读 →
论文解读

Equivariant Music Transformer

音乐生成 | 8.6/10

 · 更新于 2026-09-25 · 约 20 分钟 · 9835 字 阅读 →