让同一组录音按用户视角重新分组:AudioLens 如何把语音聚类变成集合推理
让同一组录音按用户视角重新分组:AudioLens 如何把语音聚类变成集合推理 英文题目:AudioLens: Multi-Perspective Speech Clustering with Reasoning Audio-Language Models arXiv:2608.25177 标签: #speech clustering #audio-language models #reasoning distillation #preference optimization 评分: 7.45/10 八维分项: 创新 1.7/2 | 技术严谨 1.25/1.5 | 实验充分 1.35/1.5 | 清晰度 0.9/1 | 影响力 1.2/1.5 | 开源 0/1.5 | 可复现 0.3/0.5 | 工程/实践 0.75/1.5 作者与机构: Wenjun Huang, Qiaosong Chu, Tiger Shao, Pengfei Zhang, Yutong Song, Hanning Chen, Yezi Liu, Weiyi Wu, SungHeon Jeong, Ryozo Masukawa, Sanggeon Yun, Yang Ni, Jiang Gui, Mohsen Imani ...