Deferred Audio Pruning with Local Audio-Visual Dynamics for Omni-LLMs
📄 Deferred Audio Pruning with Local Audio-Visual Dynamics for Omni-LLMs 标签:#模型剪枝 #多模态模型 #高效推理 #模型压缩 8.4/10 | 创新 1.5/2 | 严谨 1.3/1.5 | 实验 1.2/1.5 | 清晰 1/1 | 影响 1.2/1.5 | 开源 0.5/1.5 | 复现 0.5/0.5 | 工程 1.2/1.5 🔥 8.4/10 | 前25% | 文档类型:方法研究 | 评分置信度:中 | #模型剪枝 | #多模态模型 | #高效推理 #模型压缩 | arxiv 👥 作者与机构 第一作者:Kyeongyoon Lee(标注机构1,论文未提供机构名称) 通讯作者:未说明 作者列表:Kyeongyoon Lee(机构1)、Hongyeob Kim(机构1)、Youngeun Kim(机构2)、Sungeun Hong(机构1) 说明:所有机构仅以编号形式出现,论文原文未给出机构名称。 💡 毒舌点评 把“何时压缩”和“压缩哪个模态”拆开处理是本文最值得肯定的洞察:音频保留到查询条件化之后再用 query attention 剪枝,确实比所有 pre-LLM 统一压缩更合理。短板也很明显:所有对比都限定在 training-free 方法,缺少与可学习压缩/蒸馏方案的对照;“code will be released upon acceptance”意味着当前无法直接核验实现细节。此外,全部实验只在 Qwen2.5-Omni 单一骨干上进行,跨架构泛化尚未验证。 ...