论文解读

Qastanet: A DNN-Based Quality Metric for Spatial Audio

空间音频 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4668 字 阅读 →
论文解读

Reconstruction of Spherical Sound Source Radiation Characteristics with Graph Signal Processing

空间音频 | 7.5/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3232 字 阅读 →
论文解读

Regularized Inverse Filter Design for Rigid Spherical Microphone Array Processing: Laplace- And Time-Domain Representations

空间音频 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4068 字 阅读 →
论文解读

RIR-Former: Coordinate-Guided Transformer for Continuous Reconstruction of Room Impulse Responses

房间脉冲响应 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4278 字 阅读 →
论文解读

Savgbench: Benchmarking Spatially Aligned Audio-Video Generation

基准测试 | 7.5/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4030 字 阅读 →
论文解读

Secondary Source Placement for Sound Field Control Based on Ising Model

空间音频 | 6.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4089 字 阅读 →
论文解读

Sequential and Simultaneous Optimization of Microphone Array Geometry and Region-of-Interest Beamforming

声源定位 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4818 字 阅读 →
论文解读

SIREN: Spatially-Informed Reconstruction of Binaural Audio with Vision

空间音频 | 7.0/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6276 字 阅读 →
论文解读

SIRUP: A Diffusion-Based Virtual Upmixer of Steering Vectors for Highly-Directive Spatialization with First-Order Ambisonics

声源定位 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4466 字 阅读 →
论文解读

SoundCompass: Navigating Target Sound Extraction with Effective Directional Clue Integration in Complex Acoustic Scenes

语音分离 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4540 字 阅读 →
论文解读

Sparse-View Visual-Acoustic Latent Learning for Novel-View Audio Synthesis

空间音频 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5274 字 阅读 →
论文解读

Spatial Covariance Matrix Reconstruction for Speech Enhancement in Reverberant Multi-Source Environments

语音增强 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4858 字 阅读 →
论文解读

Spatial-CLAP: Learning Spatially-Aware Audio–Text Embeddings for Multi-Source Conditions

空间音频 | 8.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4905 字 阅读 →
论文解读

StereoFoley: Object-Aware Stereo Audio Generation from Video

音频生成 | 7.5/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3564 字 阅读 →
论文解读

Text2Move: Text-To-Moving Sound Generation via Trajectory Prediction and Temporal Alignment

空间音频 | 8.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4225 字 阅读 →
论文解读

Time-Domain Synthesis of Virtual Sound Source Within Personalized Sound Zone using a Linear Loudspeaker Array

空间音频 | 8.0/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3765 字 阅读 →
论文解读

Materialistic RIR: Material Conditioned Realistic RIR Generation

音频生成 | 7.5/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5449 字 阅读 →
论文解读

A state-space representation of the boundary integral equation for room acoustic modelling

本文旨在解决传统房间声学建模中多种方法(如边界元法、延迟网络、几何声学)彼此独立、缺乏统一理论基础的问题。作者提出了一种名为**边界积分算子状态空间(BIOSS)** 的新框架。该框架的核心是将描述声场的边界积分方程重新表述为一个状态空间模型,其中**状态是房间边界上的声压分布函数**,系统动态由*

 · 更新于 2026-09-24 · 约 8 分钟 · 3667 字 阅读 →
论文解读

Room compensation for loudspeaker reproduction using a supporting source

本文针对传统房间补偿技术仅能修正频谱(音色)而无法控制空间感知(如距离感)的局限,提出了一种创新的补偿方法。该方法通过引入一个延迟的、经过频谱滤波的辅助扬声器,选择性地向房间的混响声场中添加能量,从而

 · 更新于 2026-09-24 · 约 8 分钟 · 3648 字 阅读 →