论文解读

PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization

音频编码 | 7.0/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6791 字 阅读 →
论文解读

Arbitrarily Settable Frame Rate Neural Speech Codec with Content Adaptive Variable Length Segmentation

音频生成 | 7.0/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5159 字 阅读 →
论文解读

Cross-Architecture Knowledge Distillation of WavLM for Lightweight Speaker Verification

说话人验证 | 8.0/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6123 字 阅读 →
会议任务专题

ICASSP 2026 - 语音表示学习

共 1 篇 ICASSP 2026 语音表示学习 方向论文

 · 更新于 2026-09-24 · 约 4 分钟 · 1872 字 阅读 →
论文解读

Phonological Tokenizer: Prosody-Aware Phonetic Token Via Multi-Objective Fine-Tuning with Differentiable K-Means

语音表示学习 | 8.0/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5452 字 阅读 →
论文解读

The Role of Prosodic and Lexical Cues in Turn-Taking with Self-Supervised Speech Representations

语音对话系统 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4558 字 阅读 →