论文解读

Academic Text-to-Music Grand Challenge: Datasets, Baselines, and Evaluation Methods

音乐生成 | 9.9/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7170 字 阅读 →
论文解读

Evaluating Speech Articulation Synthesis with Articulatory Phoneme Recognition

语音质量评估 | 8.2/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7861 字 阅读 →
论文解读

SCRIBE: Diagnostic Evaluation and Rich Transcription Models for Indic ASR

语音识别 | 8.3/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6832 字 阅读 →
论文解读

AllocMV: Optimal Resource Allocation for Music Video Generation via Structured Persistent State

音乐视频生成 | 4.8/10

 · 更新于 2026-09-24 · 约 17 分钟 · 8053 字 阅读 →
论文解读

Toward Fine-Grained Speech Inpainting Forensics:A Dataset, Method, and Metric for Multi-Region Tampering Localization

音频深度伪造检测 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5251 字 阅读 →