论文解读

When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-24 · 约 6 分钟 · 2617 字 阅读 →
论文解读

Time vs. Layer: Locating Predictive Cues for Dysarthric Speech Descriptors in Wav2vec 2.0

语音质量评估 | 7.5/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4296 字 阅读 →