论文解读
InstructFX2FX: A Multi-turn Text-to-Preset Demo for Iterative Audio Effect Refinement
对比学习 | 8.6/10
对比学习 | 8.6/10
Integrating Facial Generation into Full-Duplex Spoken Dialogue Systems
语音识别 | 6.4/10
语音合成 | 6.6/10
说话人验证 | 7.6/10
音频水印 | 8/10
音频问答 | 6.9/10
音频水印 | 7.6/10
音乐生成 | 9.2/10
说话人验证 | 6.8/10
音乐生成 | 7.0/10
语音识别 | 5.8/10
MSU-Bench: Towards Speaker-Centric Understanding in Conversational Multi-Speaker Scenarios
Noise-Driven Instrument Based on Coherent Quantum and Stochastic Oscillator Models
语音合成 | 7.4/10
语音识别 | 7.2/10
语音识别 | 8/10
音乐信息检索 | 9/10
语音合成 | 6.7/10
基准测试 | 6.8/10