论文解读
OmniScope: Modality-Decoupled Token Compression for Omnimodal Large Language Models
音视频问答 | 8.3/10
音视频问答 | 8.3/10
语音活动检测 | 7.4/10
语音合成 | 7.6/10
语音识别 | 7.8/10
语音唤醒 | 7.1/10
音频事件检测 | 9.3/10
语音合成 | 7.9/10
音视频理解 | 5.8/10
语音情感识别 | 7.4/10
语音增强 | 7.3/10
流式处理 | 5.6/10
音频生成 | 8.0/10
语音识别 | 8.8/10
音乐生成 | 8.4/10
语音增强 | 6.5/10
语音增强 | 6.3/10
语音识别 | 7/10
音视频问答 | 5.9/10
音视频理解 | 6.3/10
音频编码 | 8.2/10