MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres
📄 MMGenre: Benchmarking Singing Voice Synthesis across Multiple Musical Genres #基准测试 #领域适应 #数据集 8.3/10 | 创新 1.5/2 | 严谨 1.2/1.5 | 实验 1.1/1.5 | 清晰 1/1 | 影响 0.8/1.5 | 开源 1.5/1.5 | 复现 0.2/0.5 | 工程 1/1.5 🔥 8.3/10 | 前25% | #基准测试 | #领域适应 | #数据集 | arxiv 👥 作者与机构 第一作者:Wenhao Feng(AIM3 Lab, Renmin University of China) 通讯作者:未明确说明(通讯邮箱为 wenhaofeng@ruc.edu.cn,推断为第一作者) 作者列表:Wenhao Feng(Renmin University of China)、Yuxun Tang(Renmin University of China)、Jiatong Shi(Carnegie Mellon University)、Qin Jin(Renmin University of China) 💡 毒舌点评 本文以“流派”为刀,一刀切开了歌唱合成领域长期自我麻醉的“风格多样性”幻觉——所有模型在非流行曲风上集体摆烂的雷达图堪称年度恐怖片。Suno 代孕产出的数据集虽有“合法避税”之巧妙,但用合成数据去诊断合成系统,到底是黑吃黑还是互相照镜子,仍要打个问号。Gemini 打分的“流派判官”角色虽与人类看似相关不低,但在 5 分制的狭窄空间里对“野嗓门”和“伪摇滚”的区别有多敏锐,恐怕连 Gemini 自己都说不清。 ...