论文解读

Mitigating Multimodal Inconsistency via Cognitive Dual-Pathway Reasoning for Intent Recognition

意图识别 | 7.0/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9463 字 阅读 →
论文解读

RADAR Challenge 2026: Robust Audio Deepfake Recognition under Media Transformations

音频深度伪造检测 | 6.0/10

 · 更新于 2026-09-25 · 约 16 分钟 · 7522 字 阅读 →
论文解读

Adaptive Regularization for Sparsity Control in Bregman-Based Optimizers

Adaptive Regularization for Sparsity Control in Bregman-Based Optimizers

 · 更新于 2026-09-25 · 约 16 分钟 · 7952 字 阅读 →
论文解读

Asymmetric Phase Coding Audio Watermarking

Asymmetric Phase Coding Audio Watermarking

 · 更新于 2026-09-25 · 约 18 分钟 · 8875 字 阅读 →
论文解读

Adaptive Diagonal Loading for Norm Constrained Beamforming

波束成形 | 7.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3730 字 阅读 →
论文解读

SEI-SHIELD: Robust Specific Emitter Identification Under Label Noise Via Self-Supervised Filtering and Iterative Rescue

信号处理 | 7.5/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6041 字 阅读 →
论文解读

Trustworthy Federated Label Distribution Learning under Annotation Quality Disparity

标签分布学习 | 8.0/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6635 字 阅读 →
论文解读

Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs

模型评估 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4862 字 阅读 →
论文解读

Contrastive Regularization for Accent-Robust ASR

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3952 字 阅读 →
论文解读

Dimensionality-Aware Anomaly Detection in Learned Representations of Self-Supervised Speech Models

语音识别 | 8.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4665 字 阅读 →
论文解读

Integrating acoustic tapping with a UAV platform for tile condition classification

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4811 字 阅读 →
论文解读

The AECM Algorithm for Deterministic Maximum Likelihood Direction Finding in the Presence of Gaussian Mixture Noise

声源定位 | 7.0/10

 · 更新于 2026-09-25 · 约 7 分钟 · 3375 字 阅读 →
论文解读

Toward Fair Speech Technologies: A Comprehensive Survey of Bias and Fairness in Speech AI

模型评估 | 7.5/10

 · 更新于 2026-09-25 · 约 4 分钟 · 1964 字 阅读 →
论文解读

A Brain-Inspired Gating Mechanism Unlocks Robust Computation in Spiking Neural Networks

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4303 字 阅读 →
论文解读

Are Deep Speech Denoising Models Robust to Adversarial Noise?

语音增强 对抗样本 | 8.5/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6237 字 阅读 →
论文解读

AudioTrust: Benchmarking The Multifaceted Trustworthiness of Audio Large Language Models

基准测试 | 7.5/10

 · 更新于 2026-09-25 · 约 16 分钟 · 7563 字 阅读 →
论文解读

Beyond Instance-Level Alignment: Dual-Level Optimal Transport for Audio-Text Retrieval

音频检索 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4524 字 阅读 →
论文解读

CTC-DRO: Robust Optimization for Reducing Language Disparities in Speech Recognition

语音识别 | 9.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4230 字 阅读 →
论文解读

Group Cognition Learning: Making Everything Better Through Governed Two-Stage Agents Collaboration

多模态模型 | 7.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5604 字 阅读 →
论文解读

JALMBench: Benchmarking Jailbreak Vulnerabilities in Audio Language Models

音频安全 | 8.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4556 字 阅读 →