每日研究速递

语音/音乐/音频论文速递 2026-05-27

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 121 分钟 · 60546 字 阅读 →
论文解读

Effective User-defined Keyword Spotting with Dual-stage Matching, Multi-modal Enrollment, and Continual Adaptation

关键词检测 | 7.4/10

 · 更新于 2026-09-06 · 约 13 分钟 · 6327 字 阅读 →
论文解读

Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks

大语言模型 | 8.5/10

 · 更新于 2026-09-06 · 约 12 分钟 · 5782 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-05-05

共分析 33 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 104 分钟 · 51662 字 阅读 →
论文解读

PACE: Pretrained Audio Continual Learning

音频分类 | 9.0/10

 · 更新于 2026-09-06 · 约 12 分钟 · 5856 字 阅读 →
论文解读

SumRA: Parameter Efficient Fine-tuning with Singular Value Decomposition and Summed Orthogonal Basis

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 12 分钟 · 5875 字 阅读 →
论文解读

PACE: Pretrained Audio Continual Learning

音频分类 | 8.5/10

 · 更新于 2026-09-06 · 约 12 分钟 · 5893 字 阅读 →
论文解读

SumRA: Parameter Efficient Fine-tuning with Singular Value Decomposition and Summed Orthogonal Basis

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4653 字 阅读 →
论文解读

Dual-LoRA: Parameter-Efficient Adversarial Disentanglement for Cross-Lingual Speaker Verification

说话人验证 | 7.0/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5273 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-05-01

共分析 21 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 70 分钟 · 35064 字 阅读 →
论文解读

Dual-LoRA: Parameter-Efficient Adversarial Disentanglement for Cross-Lingual Speaker Verification

说话人验证 | 7.5/10

 · 更新于 2026-09-06 · 约 13 分钟 · 6131 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-30

共分析 25 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 80 分钟 · 39601 字 阅读 →
论文解读

A Parameter-Efficient Multi-Scale Convolutional Adapter for Synthetic Speech Detection

A Parameter-Efficient Multi-Scale Convolutional Adapter for Synthetic Speech Detection

 · 更新于 2026-09-06 · 约 9 分钟 · 4431 字 阅读 →
论文解读

Adaptive Task-Incremental Learning For Underwater Acoustic Recognition Based on Mixture-of-Experts Adapter

水下声学目标识别 | 7.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4274 字 阅读 →
论文解读

Behind the Scenes: Mechanistic Interpretability of Lora-Adapted Whisper for Speech Emotion Recognition

语音情感识别 | 7.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3951 字 阅读 →
论文解读

Domain Partitioning Meets Parameter-Efficient Fine-Tuning: A Novel Method for Improved Language-Queried Audio Source Separation

音频分离 | 7.5/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5493 字 阅读 →
论文解读

Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3543 字 阅读 →
论文解读

GLoRIA: Gated Low-Rank Interpretable Adaptation for Dialectal ASR

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4800 字 阅读 →
论文解读

Relative Time Intervals Representation For Word-Level Timestamping With Masked Training

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4823 字 阅读 →
论文解读

WaveSP-Net: Learnable Wavelet-Domain Sparse Prompt Tuning for Speech Deepfake Detection

语音伪造检测 | 8.0/10

 · 更新于 2026-09-06 · 约 13 分钟 · 6181 字 阅读 →