论文解读

Transformer-based End-to-End Control Filter Generation for Active Noise Control

主动噪声控制 | 7.0/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6089 字 阅读 →
论文解读

Efficient Audio-Visual Speech Separation with Discrete Lip Semantics and Multi-Scale Global-Local Attention

语音分离 | 9.0/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5833 字 阅读 →
论文解读

SNAP-UQ: Self-supervised Next-Activation Prediction for Single-Pass Uncertainty in TinyML

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5831 字 阅读 →
论文解读

TINY BUT MIGHTY: A SOFTWARE-HARDWARE CO- DESIGN APPROACH FOR EFFICIENT MULTIMODAL IN- FERENCE ON BATTERY-POWERED SMALL DEVICES

多模态模型 | 7.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5357 字 阅读 →
论文解读

Predicting Upcoming Stuttering Events from Three-Second Audio: Stratified Evaluation Reveals Severity-Selective Precursors, and the Model Deploys Fully On-Device

语音生物标志物 | 7.0/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6353 字 阅读 →
论文解读

A Lightweight Fourier-Based Network for Binaural Speech Enhancement with Spatial Cue Preservation

语音增强 | 8.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4581 字 阅读 →
论文解读

A Personalized Real-Time Proactive Voice Memory Assistant

实时处理 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4384 字 阅读 →
论文解读

A Stabilized Hybrid Active Noise Control Algorithm of GFANC and FxNLMS with Online Clustering

语音增强 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4066 字 阅读 →
论文解读

Acoustic Feedback Cancellation in Hearing Aids Exploiting an Inertial Sensor

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4915 字 阅读 →
论文解读

Acoustic Non-Stationarity Objective Assessment with Hard Label Criteria for Supervised Learning Models

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3845 字 阅读 →
论文解读

Ailive Mixer: A Deep Learning Based Zero Latency Automatic Music Mixer for Live Music Performances

音乐混合 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4873 字 阅读 →
论文解读

AR-BSNet: Towards Ultra-Low Complexity Autoregressive Target Speaker Extraction With Band-Split Modeling

语音分离 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4535 字 阅读 →
论文解读

ASAP: An Azimuth-Priority Strip-Based Search Approach to Planar Microphone Array DOA Estimation in 3D

声源定位 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4472 字 阅读 →
论文解读

Atomic Norm Minimization Revisited: Progressive Atom Identification And Refinement

声源定位 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3620 字 阅读 →
论文解读

Audio Deepfake Detection at the First Greeting: "Hi!"

音频深度伪造检测 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4507 字 阅读 →
论文解读

Constraint Optimized Multichannel Mixer-Limiter Design

多通道 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4564 字 阅读 →
论文解读

Deep Learning-Based Joint Optimization of Adaptive Feedback Cancellation and Residual Feedback Suppression for Hearing Aids

语音增强 | 8.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4888 字 阅读 →
论文解读

Differentiable Grouped Feedback Delay Networks for Learning Direction and Position-Dependent Late Reverberation

空间音频 | 7.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5327 字 阅读 →
论文解读

Distributed Multichannel Active Noise Control with Asynchronous Communication

信号处理 | 8.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4052 字 阅读 →
论文解读

Enhancing Automatic Drum Transcription with Online Dynamic Few-Shot Learning

音乐信息检索 | 7.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3991 字 阅读 →