论文解读
Advancing LLM-Based Multi-Channel Multi-Speaker Speech Recognition with Global Cross-Channel Attention and Sentence-Ordered First-In First-Out Serialized Output Training
语音识别 | 7.5/10
语音识别 | 7.5/10
音乐信息检索 | 7.0/10
多模态模型 | 7.0/10
声源定位 | 6.5/10
音频深度伪造检测 | 7.5/10
音乐信息检索 | 7.5/10
语音增强 | 7.0/10
语音识别 | 7.5/10
语音识别 | 7.5/10
语音识别 | 7.5/10
语音匿名化 | 7.5/10
语音合成 | 7.5/10
语音翻译 | 7.5/10
音频深度伪造检测 | 8.0/10
声源定位 | 8.0/10
说话人分离 | 8.0/10
语音增强 | 7.5/10
语音活动检测 | 7.5/10
语音识别 | 7.5/10
音频事件检测 | 8.0/10