每日研究速递

语音/音乐/音频论文速递 2026-08-12

共分析 27 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 76 分钟 · 37591 字 阅读 →
论文解读

Speaker Role and Language Diarization for Analyzing Multilingual Interviews for Language Proficiency of Older Adults

说话人日志 | 6.3/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6762 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-11

共分析 40 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 114 分钟 · 56810 字 阅读 →
论文解读

HyPASE: Hyperbolic Geometry for Parameter-Efficient Speech Emotion Fine-Tuning Framework for Large Audio-Language Models

语音情感识别 | 7.2/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7528 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-06

共分析 26 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 73 分钟 · 36201 字 阅读 →
论文解读

Cross-cultural evaluation of taste-sound correspondences in AI-generated music

音乐理解 | 7.5/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9448 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-05

共分析 32 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 93 分钟 · 46258 字 阅读 →
论文解读

Analyzing Speech Condition Effects in Dysarthric ASR: A Layer-wise Probing Study

语音识别 | 5.0/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6341 字 阅读 →
论文解读

Normal-Anchored First-Order Model-Agnostic Meta-Learning based Whisper Fine-Tuning for Enhancing Fairness of Cleft Lip and Palate Speech Recognition

语音识别 | 5.9/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6336 字 阅读 →
论文解读

REIMU: Efficient Heterogeneous Hierarchical Reasoning for SSL-Based Speech Deepfake Detection

语音伪造检测 | 6.4/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5558 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-08-04

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 114 分钟 · 56637 字 阅读 →
论文解读

Enhancing Law-Enforcement Audio Transcription: A LoRA-Based Adaptation of Whisper for BWC Footage

语音识别 | 4.8/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5460 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-31

共分析 16 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 53 分钟 · 26338 字 阅读 →
论文解读

DuplexGen: Adaptive Synthesis of Human-AI Turn-Taking Dialogues

语音交互 | 6.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5720 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-30

共分析 19 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 60 分钟 · 30047 字 阅读 →
论文解读

From Semantics to Readout: Mechanistic Understanding of Audio Tokens after Fine-Tuning for Temporal Audio Grounding

音频理解 | 5.1/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6416 字 阅读 →
论文解读

Text-Prompted CLAP: Learning Query-Conditioned Audio Representations via Contrastive Learning

音频理解 | 6.6/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5915 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-29

共分析 27 篇语音/AI 论文

 · 更新于 2026-09-24 · 约 83 分钟 · 41435 字 阅读 →
论文解读

Automatic Audio Equalization with Semantic Embeddings

语音增强 | 5.8/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7531 字 阅读 →
论文解读

MoLGE: Mixture of Language Group Experts for Efficient Scaling of Massively Multilingual Speech Recognition

语音识别 | 6.7/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4906 字 阅读 →