论文解读

A Generalization Strategy for Speech Quality Prediction: From Domain-Specific to Unified Datasets

语音质量评估 | 6.5/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4321 字 阅读 →
论文解读

A Robust Multi-Scale Framework with Test-Time Adaptation for sEEG-Based Speech Decoding

语音解码 | 7.5/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4193 字 阅读 →
论文解读

A Unsupervised Domain Adaptation Framework For Semi-Supervised Melody Extraction Using Confidence Matrix Replace and Nearest Neighbour Supervision

音乐信息检索 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4391 字 阅读 →
论文解读

AccLID: Accent-aware Language Identification for Robust Multilingual Speech Recognition

语音识别 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4432 字 阅读 →
论文解读

Advancing Semi-Supervised Child Speech Recognition with Omni-Temporal Classification under Label Noise

语音识别 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4912 字 阅读 →
论文解读

Automatic Music Mixing Using a Generative Model of Effect Embeddings

音乐生成 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5057 字 阅读 →
论文解读

Bayesian Low-Rank Factorization for Robust Model Adaptation

语音识别 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4176 字 阅读 →
论文解读

BEST-RQ-based Self-Supervised Learning for Whisper Domain Adaptation

语音识别 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5130 字 阅读 →
论文解读

Beyond Mapping: Domain-Invariant Representations via Spectral Embedding of Optimal Transport Plans

领域适应 | 7.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5892 字 阅读 →
论文解读

CCST: Cross-Modal and Consistency-Aware Self-Training for Source-Free Unsupervised Domain Adaptation in Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6342 字 阅读 →
论文解读

Cross-Domain Contrastive Learning with Dynamic Threshold Calibration for Source Speaker Tracing

说话人验证 | 8.0/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3746 字 阅读 →
论文解读

DDSC: Dynamic Dual-Signal Curriculum for Data-Efficient Acoustic Scene Classification Under Domain Shift

音频场景分类 | 7.0/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3676 字 阅读 →
论文解读

DISSR: Disentangling Speech Representation for Degradation-Prior Guided Cross-Domain Speech Restoration

语音增强 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5058 字 阅读 →
论文解读

Domain Partitioning Meets Parameter-Efficient Fine-Tuning: A Novel Method for Improved Language-Queried Audio Source Separation

音频分离 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5493 字 阅读 →
论文解读

Domain-Aware Scheduling for ASR Fine-Tuning

语音识别 | 6.5/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4493 字 阅读 →
论文解读

Domain-Invariant Representation Learning of Bird Sounds

生物声学 | 6.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5091 字 阅读 →
论文解读

Dual Contrastive Learning for Semi-Supervised Domain Adaptation in Bi-Modal Depression Recognition

语音生物标志物 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4365 字 阅读 →
论文解读

Dynamic Noise-Aware Multi Lora Framework Towards Real-World Audio Deepfake Detection

音频深度伪造检测 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4267 字 阅读 →
论文解读

Emo-TTA: Improving Test-Time Adaptation of Audio-Language Models for Speech Emotion Recognition

语音情感识别 | 7.0/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4628 字 阅读 →
论文解读

Enhancing Automatic Drum Transcription with Online Dynamic Few-Shot Learning

音乐信息检索 | 7.0/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3991 字 阅读 →