论文解读

Monophonic Audio Synthesizer Using FPGAs

音频生成 | 4.2/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5225 字 阅读 →
论文解读

A Unifying Perspective on Audio Generative Modeling: Latent Representations and Modeling Strategies

音频生成 | 6.5/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8964 字 阅读 →
论文解读

Beyond Reconstruction: Full-Context Generative DiT for Music Generation

音乐生成 | 7.5/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7890 字 阅读 →
论文解读

Dramarrator: Object-Based Audio Editing for Audio Drama Production from Books

音频生成 | 7.0/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6691 字 阅读 →
论文解读

MADBench: A Benchmark for Modality-Aware Audio Deepfake Detection

音视频理解 | 6.6/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6883 字 阅读 →
论文解读

RAG-Audio: Retrieval-Augmented Generation for Faithful Brain-to-Audio Reconstruction

音频生成 | 6.9/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9065 字 阅读 →
论文解读

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation

音频生成 | 7.6/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9341 字 阅读 →
论文解读

VIOLET: High-Fidelity Violin Synthesis with Techniques and Dynamics

音乐生成 | 7.6/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7116 字 阅读 →
论文解读

MMAG: A Multi-Control Mixed Audio Generation Benchmark

音频生成 | 6.8/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7097 字 阅读 →
论文解读

Objects as Audio-Visual Modal Sound Fields

音频生成 | 7.6/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6923 字 阅读 →
论文解读

Diff2Mix: Controllable Music Mixing via Diffusion Models and Differentiable Audio Effects

音频生成 | 7.5/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7204 字 阅读 →
论文解读

EG-VAE: A Unified Framework for Electric Guitar Tone Transfer and Removal

音频生成 | 7.3/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7237 字 阅读 →
论文解读

AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation

音频生成 | 6.8/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5452 字 阅读 →
论文解读

Visual Representation Matters: Exploiting Temporal Differences in Video-to-Audio Generation

音视频生成 | 6.8/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9417 字 阅读 →
论文解读

AI-Based Sound Effect Generation: A Narrative Review of Generative Models Across Input Modalities

音频生成 | 6.9/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6230 字 阅读 →
论文解读

DDSynth-RL: Audio Synthesizer Inversion via Discrete Diffusion with Reinforcement Learning

音频生成 | 7.0/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6266 字 阅读 →
论文解读

MEMS Microphones as Ultrasonic Transducers: Nonlinear Electrostatic Actuation and a Parametric Array Prototype

音频生成 | 5.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5133 字 阅读 →
论文解读

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

音频生成 | 7.0/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8583 字 阅读 →
论文解读

SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks

音频生成 | 7.1/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7166 字 阅读 →
论文解读

Exploring Efficient Waveform Diffusion Models for Foley Sound Generation

音频生成 | 6.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6173 字 阅读 →