论文解读

Looking for Affect in Spontaneous Finnish Speech through Linguistic Interpretability

语音情感识别 | 5.3/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5152 字 阅读 →
论文解读

Singlish, Can or Not? Fine-Tuning and Evaluating Zero-Shot TTS for Singapore English

语音合成 | 6.3/10

 · 更新于 2026-09-25 · 约 16 分钟 · 7963 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-28

共分析 31 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 103 分钟 · 51404 字 阅读 →
论文解读

MEUSLI: a Multilingual Projector for LLM-based ASR and Beyond

语音识别 | 8.2/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6955 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-27

共分析 13 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 39 分钟 · 19087 字 阅读 →
论文解读

DONDO: Open w2v-BERT Speech-Recognition Base Models for African Languages

语音识别 | 8.1/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7224 字 阅读 →
论文解读

Phonetic forced alignment for low-resource language varieties: Model training and evaluation on Chengdu Mandarin

语音识别 | 6.2/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7221 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-24

共分析 18 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 57 分钟 · 28385 字 阅读 →
论文解读

CAPS: A Cascaded Reconstruction Model to Power Saving in Hearables Using Sub-Nyquist Sampling with Bandwidth Extension

语音增强 | 6.6/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7493 字 阅读 →
论文解读

Cross-Subject Semantic Decoding with Shared-Space Alignment for Generalized Neural Representation Learning

语音交互 | 6.3/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6689 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-23

共分析 21 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 70 分钟 · 34984 字 阅读 →
论文解读

A Situational Speech Synthesizer for Yoruba: System Design, Phonological Rule Architecture, and Orthographic Extensions for Contour

语音合成 | 6.7/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6602 字 阅读 →
论文解读

Constrained CTC Decoding for Efficient Diacritic Restoration

语音识别 | 7.7/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6374 字 阅读 →
论文解读

From a Multilingual Streaming ASR Backbone to Kenyan-Language Systems: Data-Centric Adaptation of Nemotron 3.5 for Kikuyu, Dholuo, and Kalenjin

语音识别 | 6.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4601 字 阅读 →
论文解读

Staged Depth-Pruning Distillation of a Flow-Matching Text-to-Speech Teacher: A Compact Hindi Speech Synthesizer

语音合成 | 7.9/10

 · 更新于 2026-09-25 · 约 17 分钟 · 8461 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-22

共分析 20 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 71 分钟 · 35132 字 阅读 →
论文解读

Explainable Lightweight Compact Deep Models for Speech Emotion Recognition

语音情感识别 | 5.4/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9115 字 阅读 →
论文解读

Pseudo-label distillation for discriminative anomalous sound detection

音频事件检测 | 9.0/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7353 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-21

共分析 34 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 118 分钟 · 58810 字 阅读 →
论文解读

Can Tokens Compete? Token Representations against Supervised CNN Backbones for BirdCLEF+ 2026

音频事件检测 | 8.3/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9493 字 阅读 →