论文解读
DrVoice: Parallel Speech-Text Voice Conversation Model via Dual-Resolution Speech Representations
语音对话系统 | 9.5/10
语音对话系统 | 9.5/10
音频问答 | 8.5/10
语音分离 | 7.5/10
语音对话系统 | 8.5/10
音视频事件检测 | 8.5/10
跨模态生成 | 9.5/10
语音合成 | 8.0/10
语音对话系统 | 8.5/10
音乐理解 | 7.0/10
多模态模型 | 7.5/10
多模态模型 | 8.5/10
语音对话系统 | 7.5/10
共 5 篇 ICLR 2026 多模态模型 方向论文
音视频 | 7.0/10
音视频 | 9.0/10
音视频联合推理 | 7.0/10
音乐理解 | 8.0/10
音频生成 | 7.5/10
跨模态检索 | 7.5/10
音乐信息检索 | 7.0/10