论文解读

Breaking Shortcut Learning for Cross-Trial EEG-Guided Target Speech Extraction via Two-Stage Training

对比学习 | 8.6/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5745 字 阅读 →
论文解读

Comparative Reasoning: Making an Audio Language Model Better at Comparing Emotions

语音情感识别 | 7.5/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6591 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-06-24

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 98 分钟 · 48791 字 阅读 →
论文解读

CAAD: Contrastive Audio-Aware Distillation for Efficient Speech Language Models

语音识别 | 8.9/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5368 字 阅读 →
论文解读

CoughPhase-CLR: Designing an acoustics-informed foundation model for coughing sound classification

对比学习 | 10/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5062 字 阅读 →
论文解读

Cross-lingual Retrieval-Augmented Classification for Dysarthria Severity Assessment

语音识别 | 8.4/10

 · 更新于 2026-09-25 · 约 21 分钟 · 10226 字 阅读 →
论文解读

Direct Raw Audio Signal Processing via Reservoir Computing: An Investigation into 'Feature-Free' Architectures

语音识别 | 4.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4329 字 阅读 →
论文解读

InstructFX2FX: A Multi-turn Text-to-Preset Demo for Iterative Audio Effect Refinement

对比学习 | 8.6/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5470 字 阅读 →
论文解读

PrefSQA: Pairwise Preference Prediction for Speech Quality Assessment and the Critical Role of High Quality Datasets

语音质量评估 | 7.3/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5828 字 阅读 →
论文解读

Segment-Level Mandarin Chinese Speech-Based Cognitive Impairment Detection via an Autoencoder with Contrastive Learning

对比学习 | 6.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5574 字 阅读 →
论文解读

Transcript-Free Flow-Matching Text-to-Speech via Speech Feature Conditioning

语音合成 | 7.7/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4674 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-06-19

共分析 40 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 110 分钟 · 54842 字 阅读 →
论文解读

Learning Robust Pair Confidence for Multimodal Emotion-Cause Pair Extraction

多模态模型 | 7.5/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6808 字 阅读 →
论文解读

Learning task-specific subspaces via interventional post-training of speech foundation models

自监督学习 | 6.2/10

 · 更新于 2026-09-25 · 约 21 分钟 · 10293 字 阅读 →
论文解读

Unsupervised Approaches for Global Prosodic Embedding Extraction

语音合成 | 7.8/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6086 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-06-15

共分析 26 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 72 分钟 · 35999 字 阅读 →
论文解读

From Tokens to Faces: Investigating Discrete Speech Representations for 3D Facial Animation

语音合成 | 7.9/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6037 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-06-12

共分析 27 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 77 分钟 · 38140 字 阅读 →
论文解读

Lung-SRAD: Spectral-Aware Regularized Audio DASS with Dual-Axis Patch-Mix Contrastive Learning for Respiratory Sound Classification

对比学习 | 6.8/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5479 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-06-11

共分析 36 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 99 分钟 · 49581 字 阅读 →