论文解读
RCAL: Reinforced Cross-Modal Alignment for Multimodal Sentiment Analysis with Sparse Visual Frames
多模态模型 | 8.5/10
多模态模型 | 8.5/10
数据集 | 7.5/10
生物声学 | 7.0/10
实体消歧 | 8.0/10
音频压缩 | 7.5/10
音频分类 零样本学习 | 7.0/10
音频检索 | 8.0/10
语音情感识别 | 6.5/10
语音合成 | 7.0/10
空间音频 | 8.5/10
语音情感识别 | 8.0/10
医疗AI | 7.5/10
语音驱动动作生成 | 7.0/10
关键词检测 | 7.5/10
音频事件检测 | 8.5/10
模型评估 | 8.0/10
音乐理解 | 7.5/10
语音识别 | 7.5/10
音频检索 | 8.0/10
音频检索 | 7.5/10