论文解读

A Parameter-Efficient Multi-Scale Convolutional Adapter for Synthetic Speech Detection

A Parameter-Efficient Multi-Scale Convolutional Adapter for Synthetic Speech Detection

 · 更新于 2026-09-25 · 约 9 分钟 · 4431 字 阅读 →
论文解读

AFT: An Exemplar-Free Class Incremental Learning Method for Environmental Sound Classification

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4408 字 阅读 →
论文解读

AISHELL6-Whisper: A Chinese Mandarin Audio-Visual Whisper Speech Dataset with Speech Recognition Baselines

语音识别 | 8.3/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4735 字 阅读 →
论文解读

CASTELLA: Long Audio Dataset with Captions and Temporal Boundaries

音频检索 | 8.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3821 字 阅读 →
论文解读

Discrete-Continuous Fusion With Adaptive Hierarchical Features For Audio Deepfake Detection

音频深度伪造检测 | 8.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4332 字 阅读 →
论文解读

E2E-AEC: Implementing An End-To-End Neural Network Learning Approach for Acoustic Echo Cancellation

语音增强 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4163 字 阅读 →
论文解读

Efficient Depression Detection from Speech via Language-Independent Prompt-Driven Reprogramming

语音生物标志物 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4393 字 阅读 →
论文解读

Exploring Fine-Tuning Of Large Audio Language Models For Spoken Language Understanding Under Limited Speech Data

语音理解 | 8.0/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3549 字 阅读 →
论文解读

Fine-Tuning Large Audio-Language Models with Lora for Precise Temporal Localization of Prolonged Exposure Therapy Elements

音频事件检测 | 6.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5707 字 阅读 →
论文解读

FlowSE-GRPO: Training Flow Matching Speech Enhancement via Online Reinforcement Learning

语音增强 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4353 字 阅读 →
论文解读

From Human Speech to Ocean Signals: Transferring Speech Large Models for Underwater Acoustic Target Recognition

水下声学目标识别 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4052 字 阅读 →
论文解读

Generalizability of Predictive and Generative Speech Enhancement Models to Pathological Speakers

语音增强 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4542 字 阅读 →
论文解读

GLUE: Gradient-free Learning to Unify Experts

迁移学习 | 6.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5139 字 阅读 →
论文解读

How Far Do SSL Speech Models Listen for Tone? Temporal Focus of Tone Representation under Low-Resource Transfer

语音识别 | 6.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3861 字 阅读 →
论文解读

Human-1 by Josh Talks: A Full-Duplex Conversational Modeling Framework in Hindi using Real-World Conversations

语音对话系统 | 7.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5611 字 阅读 →
会议任务专题

ICASSP 2026 - 迁移学习

共 1 篇 ICASSP 2026 迁移学习 方向论文

 · 更新于 2026-09-25 · 约 4 分钟 · 1504 字 阅读 →
论文解读

Improving Active Learning for Melody Estimation by Disentangling Uncertainties

音乐信息检索 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4455 字 阅读 →
论文解读

Influence-Aware Curation and Active Selection for Industrial and Surveillance Sound Events

音频事件检测 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 5004 字 阅读 →
论文解读

Interval-Aware Retrieval Framework For Speech-Based Automatic Alzheimer’s Detection

语音生物标志物 | 8.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4971 字 阅读 →
论文解读

It Is Personal: The Importance of Personalization for Recognizing Self-Reported Emotion

语音情感识别 | 8.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4215 字 阅读 →