论文解读

Towards Robust Generative Speech Enhancement Using Vector Quantisation-Based Neural Audio Codec

语音增强 | 5.9/10

 · 更新于 2026-09-25 · 约 18 分钟 · 8860 字 阅读 →
论文解读

HIDVAS: A Hearing Instrument Dataset in Various Acoustical Scenarios for Algorithm Evaluation and Training

语音增强 | 9/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4950 字 阅读 →
论文解读

BASENet: Band-Adapted Speech Enhancement Network with Cross-Band Attention

语音增强 | 7.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5907 字 阅读 →
论文解读

Generating Training Targets for Real-World Speech Enhancement via Close-to-Distant Microphone Projection

语音增强 | 6.4/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4533 字 阅读 →
论文解读

HALO: Half-Frame-Rate Adaptive Learnable Operator for Lightweight STFT-Based Speech Enhancement

语音增强 | 8.4/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4830 字 阅读 →
论文解读

G-MaP-SE: Guided Speech Enhancement via GMM-Based Prior Matching

语音增强 | 9.3/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5176 字 阅读 →
论文解读

Paediatric-HGNN: A Hybrid Heterogeneous Graph Neural Network for Detecting Disfluency in Children's Speech via Multiscale Acoustic Fusion

语音合成 | 6.5/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7186 字 阅读 →
论文解读

BiEAR: A Human Auditory-Inspired Adaptive Binaural Front-end for Multi-Speaker Localisation and Distance Estimation

声源定位 | 8.5/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7142 字 阅读 →
论文解读

SEAM: Shortcut-Aware Real-Time Detection of Scripted vs. Spontaneous Speech for Interview Guardrails

语音增强 | 7.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5847 字 阅读 →
论文解读

DBHN-Net: Dual-Branch Hybrid Neural Network For Low-Complexity Monaural Speech Enhancement

语音增强 | 5.4/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6912 字 阅读 →
论文解读

SB-RF: Schrödinger Bridge Rectified Flow for One-Step Robust Speech Enhancement

语音增强 | 7.6/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5309 字 阅读 →
论文解读

Feasibility of Time-Domain DNN-Based Speech Enhancement on Embedded FPGA for Hearing Aid

语音增强 | 7.2/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5671 字 阅读 →
论文解读

The Differentiable Auditory Loop (DAL): An ML Framework for Hyper-Personalized Hearing Aids

语音增强 | 7.1/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5340 字 阅读 →
论文解读

A Comparison of Generative and Discriminative Methods for Speech Enhancement: Robustness, Complexity, and Hallucination

语音增强 | 8.3/10

 · 更新于 2026-09-25 · 约 14 分钟 · 7008 字 阅读 →
论文解读

Exploiting Noise Inseparability for Weakly-Supervised Discriminative Speech Denoising Using Noisy Targets

语音增强 | 8.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4979 字 阅读 →
论文解读

Advancing Electrolaryngeal Speech Enhancement Through Speech-Text Representation Learning

语音增强 | 7.1/10

 · 更新于 2026-09-25 · 约 17 分钟 · 8092 字 阅读 →
论文解读

On the Use of Dereverberation for Acoustic Feedback Cancellation

语音增强 | 6.7/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3988 字 阅读 →
论文解读

Benchmarking AI for low-resource contexts: Thinking beyond leaderboards

语音识别 | 5.1/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6151 字 阅读 →
论文解读

Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5492 字 阅读 →
论文解读

Linearly Constrained Deep Beamformer for Multi-Speaker Scenarios

语音增强 | 7.3/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7293 字 阅读 →