论文解读

Bridging the Gap: Converting Read Text to Conversational Dialogue

语音转换 | 3.1/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5452 字 阅读 →
论文解读

Improving Automatic Speech Recognition for Speakers Treated for Oral Cancer using Data Augmentation and LLM Error Correction

语音识别 | 6/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8703 字 阅读 →
论文解读

Exploring Token-Space Manipulation in Latent Audio Tokenizers

音频编码 | 6.5/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9238 字 阅读 →
论文解读

Phoneme-Level Deepfake Detection Across Emotional Conditions Using Self-Supervised Embeddings

音频深度伪造检测 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4325 字 阅读 →
论文解读

TVTSyn: Content-Synchronous Time-Varying Timbre for Streaming Voice Conversion and Anonymization

语音转换 语音匿名化 | 8.0/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6522 字 阅读 →
论文解读

TVTSyn: Content-Synchronous Time-Varying Timbre for Streaming Voice Conversion and Anonymization

语音转换 | 7.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6178 字 阅读 →
论文解读

Accent Conversion: A Problem-Driven Survey of Sociolinguistic and Technical Constraints

语音转换 | 7.5/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3936 字 阅读 →
论文解读

DiffAnon: Diffusion-based Prosody Control for Voice Anonymization

语音匿名化 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4816 字 阅读 →
论文解读

Conditional Diffusion Models for Mental Health-Preserving Voice Conversion

语音转换 | 8.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4927 字 阅读 →
论文解读

CosyAccent: Duration-Controllable Accent Normalization using Source-Synthesis Training Data

语音转换 | 7.8/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5037 字 阅读 →
论文解读

Expressive Voice Conversion with Controllable Emotional Intensity

语音转换 | 7.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5587 字 阅读 →
论文解读

FAC-FACodec: Controllable Zero-Shot Foreign Accent Conversion with Factorized Speech Codec

语音转换 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4319 字 阅读 →
会议任务专题

ICASSP 2026 - 语音转换

共 9 篇 ICASSP 2026 语音转换 方向论文

 · 更新于 2026-09-24 · 约 28 分钟 · 14024 字 阅读 →
论文解读

Leveraging Text-to-Speech and Voice Conversion as Data Augmentation for Alzheimer's Disease Detection from Spontaneous Speech

语音生物标志物 | 7.0/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5134 字 阅读 →
论文解读

Lightweight and Perceptually-Guided Voice Conversion for Electro-Laryngeal Speech

语音转换 | 7.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6301 字 阅读 →
论文解读

MaskVCT: Masked Voice Codec Transformer for Zero-Shot Voice Conversion with Increased Controllability via Multiple Guidances

语音转换 | 6.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5363 字 阅读 →
论文解读

MeanVC: Lightweight and Streaming Zero-Shot Voice Conversion via Mean Flows

语音转换 | 7.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5574 字 阅读 →
论文解读

MeanVoiceFlow: One-Step Nonparallel Voice Conversion with Mean Flows

语音转换 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4492 字 阅读 →
论文解读

QE-XVC: Zero-Shot Cross-Lingual Voice Conversion via Query-Enhancement and Conditional Flow Matching

语音转换 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4561 字 阅读 →
论文解读

Quantifying Speaker Embedding Phonological Rule Interactions in Accented Speech Synthesis

语音合成 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4134 字 阅读 →