论文解读
From Inpainting to Editing: Unlocking Robust Mask-Free Visual Dubbing via Generative Bootstrapping
扩散模型 | 7.6/10
扩散模型 | 7.6/10
音视频理解 | 7.3/10
音频编码 | 8.2/10
声源定位 | 8.1/10
语音识别 | 9.3/10
语音交互 | 8.1/10
模型压缩 | 6.3/10
音频理解 | 6.4/10
语音合成 | 6.1/10
多模态模型 | 5.2/10
多模态模型 | 8/10
音视频理解 | 6.8/10
音视频语音分离 | 6.2/10
音视频理解 | 6.3/10
音视频问答 | 7.3/10
音视频理解 | 3.6/10
音视频理解 | 7.2/10
音频分离 | 9.2/10
音视频生成 | 7.2/10
音频修复 | 8/10