论文解读
InstructAudio: Unified Speech and Music Generation with Natural Language Instruction
语音合成 | 7.5/10
语音合成 | 7.5/10
音乐生成 | 7.0/10
语音合成 | 7.5/10
说话人分离 | 6.5/10
语音情感识别 | 7.5/10
音乐理解 | 7.5/10
语音生物标志物 | 8.5/10
语音识别 | 7.5/10
模型评估 | 6.5/10
语音识别 | 7.0/10
语音增强 | 6.0/10
语音情感识别 | 8.0/10
语音识别 语音翻译 | 7.0/10
语音增强 | 7.5/10
音乐理解 | 7.5/10
主动降噪 | 7.5/10
语音增强 | 7.0/10
语音识别 | 7.5/10
📄 保留高维 XLS-R 特征时单层 KAN 能否以更少参数替代复杂后端 会议论文 ID:conference:icassp:2026:icassp-arnumber:11460320
音频问答 | 7.5/10