论文解读
Probing Cross-modal Information Hubs in Audio-Visual LLMs
模型分析 | 6.5/10
模型分析 | 6.5/10
音视频问答 | 6.0/10
MIST: Multimodal Interactive Speech-based Tool-calling Conversational Assistants for Smart Homes
Sparse Autoencoders as Plug-and-Play Firewalls for Adversarial Attack Detection in VLMs
共分析 12 篇语音/AI 论文
跨模态 | 8.0/10
移动代理 | 6.5/10
共分析 3 篇语音/AI 论文
语音情感识别 | 8.0/10
音频质量评估 | 8.5/10
音频分类 | 7.5/10
语音情感识别 | 8.0/10
共分析 22 篇语音/AI 论文
说话头伪造检测 | 7.5/10
语音对话系统 | 7.5/10
音频检索 | 7.5/10
多模态模型 | 7.0/10
共分析 23 篇语音/AI 论文
基准测试 | 7.5/10
音视频 | 7.5/10