论文解读
CoVA: Text-Guided Composed Video Retrieval for Audio-Visual Content
跨模态检索 | 6.5/10
跨模态检索 | 6.5/10
语音识别 | 7.5/10
说话人生成 | 7.0/10
音频问答 | 7.5/10
音频问答 | 7.0/10
音频生成 | 7.5/10
音频生成 | 7.5/10
共 6 篇 ICASSP 2026 音视频 方向论文
音频生成 | 7.5/10
语音识别 | 7.0/10
舞蹈生成 | 7.5/10
音频深度伪造检测 | 6.5/10
语音情感识别 | 8.0/10
语音识别 | 8.0/10
语音识别 | 8.5/10
歌唱语音合成 | 4.5/10
语音分离 | 7.5/10
说话人合成 | 7.5/10
语音识别 | 7.5/10
音视频 | 7.0/10