论文解读
Ex-Omni-2D: Expressive Omni-Modal Dialogue Models with Native Visual Presence
音视频生成 | 6.5/10
音视频生成 | 6.5/10
音乐生成 | 6.6/10
语音情感识别 | 7.2/10
语音识别 | 6.1/10
共分析 27 篇语音/AI 论文
模型剪枝 | 8.4/10
音视频语音识别 | 6.6/10
多模态模型 | 5.9/10
音视频问答 | 6.7/10
音视频理解 | 6.6/10
语音情感识别 | 6.5/10
音频检索 | 7.2/10
音频生成 | 6.9/10
音频字幕生成 | 8.0/10
音视频理解 | 7.7/10
音乐检索 | 7.7/10
语音属性识别 | 6.5/10
共分析 40 篇语音/AI 论文
音频生成 | 7.6/10
音视频交互 | 5.7/10