论文解读

Hearing Like Humans? Sound Symbolism and Perceptual Alignment in Speech Language Models

多模态模型 | 6.1/10

 · 更新于 2026-09-25 · 约 25 分钟 · 12190 字 阅读 →
论文解读

Transcript-Free Lightweight Detection of Alzheimer's Disease from Spontaneous Speech Using Handcrafted MFCC-Dominant Acoustic Biomarkers

语音属性识别 | 4.9/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6802 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-14

共分析 53 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 186 分钟 · 92760 字 阅读 →
论文解读

Multimodal Digital Biomarker for Asthma: Complementary Roles of Vocal, Clinical and Demographic Factors

多模态模型 | 5.3/10

 · 更新于 2026-09-25 · 约 17 分钟 · 8394 字 阅读 →
论文解读

Multimodal Digital Biomarker for Asthma: Complementary Roles of Vocal, Clinical and Demographic Factors

语音属性识别 | 5.8/10

 · 更新于 2026-09-25 · 约 18 分钟 · 8539 字 阅读 →
论文解读

SHAP-Weighted Cross-Modal Expert Fusion for Emotion and Sentiment Recognition: Evidence and Limits

语音情感识别 | 7.7/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5806 字 阅读 →
论文解读

SHAP-Weighted Cross-Modal Expert Fusion for Emotion and Sentiment Recognition: Evidence and Limits

多模态模型 | 4.5/10

 · 更新于 2026-09-25 · 约 20 分钟 · 9967 字 阅读 →
论文解读

Structural Bottlenecks on Frequency Representation in End-to-End Audio Models

音频生成 | 7.6/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6425 字 阅读 →
论文解读

Structural Bottlenecks on Frequency Representation in End-to-End Audio Models

音频编码 | 7.4/10

 · 更新于 2026-09-25 · 约 17 分钟 · 8095 字 阅读 →
论文解读

Why Do You Say It Like That? A Phoneme-Level Framework for Explainable Speech Deepfake Detection

语音伪造检测 | 6.5/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6461 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-10

共分析 19 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 64 分钟 · 31889 字 阅读 →
论文解读

Gradient-Based Speech-to-Text Alignment for Any ASR Model: From CTC to Speech LLMs

语音识别 | 7.3/10

 · 更新于 2026-09-25 · 约 18 分钟 · 8554 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-09

共分析 13 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 47 分钟 · 23491 字 阅读 →
论文解读

Designing Maintainable Hybrid Generative Systems: A Quantum-Inspired Approach to Automated Music Harmony Generation

音乐生成 | 5.3/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5880 字 阅读 →
论文解读

Escaping the Procrustean Bed: Groupwise Orthogonal Connectors for Audio-Language Models

语音属性识别 | 7.8/10

 · 更新于 2026-09-25 · 约 7 分钟 · 3485 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-07-08

共分析 26 篇语音/AI 论文

 · 更新于 2026-09-25 · 约 84 分钟 · 41962 字 阅读 →
论文解读

An Intervention-Based Framework for Shortcut Diagnosis in Spoofing Countermeasures

语音伪造检测 | 6.1/10

 · 更新于 2026-09-25 · 约 22 分钟 · 10952 字 阅读 →
论文解读

Information-Geometric Superposed Vowel Evaluation: Part 1. Moraic Syllabary (Japanese)

语音伪造检测 | 1.9/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5404 字 阅读 →
论文解读

MOSAIC: Interpretable Multi-Token Cross-Attention of Biophonetic and Self-Supervised Representations for Unified Voice Anti-Spoofing

语音伪造检测 | 6.3/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7094 字 阅读 →
论文解读

Open-Set Source Tracing as Compositional Factors via Structured Prototypes

语音伪造检测 | 6/10

 · 更新于 2026-09-25 · 约 14 分钟 · 6596 字 阅读 →