论文解读
Optimal Transport-based Semantic Alignment for LLM-based Audio-Visual Speech Recognition
音视频语音识别 | 6.9/10
音视频语音识别 | 6.9/10
语音识别 | 7.7/10
音视频理解 | 6.4/10
语音分离 | 6.6/10
音乐理解 | 5.3/10
音乐生成 | 5.6/10
音频事件检测 | 7.2/10
共分析 1 篇语音/AI 论文
音乐生成 | 8.4/10
音频事件检测 | 8.3/10
语音质量评估 | 6.7/10
语音识别 | 8.2/10
音频理解 | 6.9/10
语音增强 | 6.5/10
音乐转录 | 7.7/10
语音识别 | 6.4/10
语音分离 | 8.0/10
语音情感识别 | 7.7/10
音频生成 | 7.6/10
音视频交互 | 5.2/10