论文解读
SED: Structural Entropy Based Speech Discretization for Discrete Token-Based ASR
语音识别 | 6.5/10
语音识别 | 6.5/10
音频问答 | 7.0/10
音频事件检测 | 7.0/10
多模态模型 | 6.5/10
多音高估计 音符跟踪 | 8.5/10
语音摘要 | 7.5/10
音频分类 零样本学习 | 7.0/10
语音翻译 | 7.5/10
音乐分离 | 7.0/10
语音识别 | 6.5/10
声源定位 | 7.5/10
语音评估 | 7.5/10
语音合成 | 7.0/10
音频事件检测 | 8.5/10
语音增强 | 7.0/10
语音增强 | 8.5/10
音频问答 | 7.5/10
音乐信息检索 | 7.0/10
音乐生成 | 7.5/10
说话人分离 | 7.0/10