InCarEmo: A Multimodal Dataset for In-Cabin Emotion Recognition and Driver State Monitoring
📄 InCarEmo: A Multimodal Dataset for In-Cabin Emotion Recognition and Driver State Monitoring 标签:#多模态模型 #对比学习 #数据集 #基准测试 #智能座舱 7.3/10 | 创新 1.1/2 | 严谨 1.1/1.5 | 实验 1/1.5 | 清晰 0.9/1 | 影响 0.5/1.5 | 开源 1.2/1.5 | 复现 0.3/0.5 | 工程 1.2/1.5 ✅ 7.3/10 | 前50% | 文档类型:数据集与基准 | 评分置信度:高 | #多模态模型 | #对比学习 | #数据集 #基准测试 | arxiv 👥 作者与机构 第一作者:Hao Yang(哈尔滨工业大学) 通讯作者:Bing Qin(哈尔滨工业大学)(论文未明确标注通讯作者,但根据作者列表最后一位及邮箱格式推断) 作者列表:Hao Yang(哈尔滨工业大学)、Yanyan Zhao(哈尔滨工业大学)、Kewei Zhao(哈尔滨工业大学)、Hongbo Zhang(哈尔滨工业大学)、Tian Zheng(哈尔滨工业大学)、Yusheng Liu(哈尔滨工业大学)、Xing Fu(哈尔滨工业大学)、Bichen Wang(哈尔滨工业大学)、Yu Zhang(哈尔滨工业大学)、Hao He(SERES)、Zhen Wu(SERES)、Xuda Zhi(SERES)、Yongbo Huang(SERES)、Bing Qin(哈尔滨工业大学) 💡 毒舌点评 论文在座舱场景中创新性地融合了对话文本和红外模态,数据构建流程规范且具有工程价值。然而,其核心卖点之一——用于“跨语言评估”的英文基准——完全依赖质量不可控的机器合成语音,这不仅引入了严重的偏差,更使其关于跨语言性能的结论沦为一项对语音合成技术的间接评估,极大地削弱了研究的科学严谨性。模型比较的公平性也存在疑问。 ...