论文解读

孤独听得出来吗:当说什么比怎么说更诚实

语音情感识别 | 4.9/10

 · 更新于 2026-09-24 · 约 17 分钟 · 8019 字 阅读 →
论文解读

听见了却不听从:音频大模型在编码器里记住语气,在解码器里忘记语气

语音情感识别 | 6.0/10

 · 更新于 2026-09-24 · 约 29 分钟 · 14405 字 阅读 →
论文解读

只记得你说了什么,却忘了你怎么说的:长程副语言记忆的缺口

语音情感识别 | 7.1/10

 · 更新于 2026-09-24 · 约 23 分钟 · 11195 字 阅读 →
论文解读

朗读课文不该读出抑郁:用证据边界把筛查关进可审计的笼子

语音情感识别 | 7.0/10

 · 更新于 2026-09-24 · 约 23 分钟 · 11117 字 阅读 →
论文解读

议会里的声音政治学:当情感、犹豫与重音在四种斯拉夫语中分道扬镳

语音情感识别 | 5.6/10

 · 更新于 2026-09-24 · 约 24 分钟 · 11892 字 阅读 →
论文解读

当模型听得见声音,却听不懂语气:VocalAffectBench 为何要把情感从文字里剥离

语音情感识别 | 7.4/10

 · 更新于 2026-09-24 · 约 25 分钟 · 12243 字 阅读 →
论文解读

模型听见的是期待的语调:当讽刺检测依赖高音与停顿的刻板印象

语音情感识别 | 7.4/10

 · 更新于 2026-09-24 · 约 27 分钟 · 13353 字 阅读 →
论文解读

当声音在笑、文字在哭:大音频语言模型为何听不见讽刺

语音情感识别 | 8.1/10

 · 更新于 2026-09-24 · 约 25 分钟 · 12067 字 阅读 →
论文解读

文字答得滴水不漏,声音却露了怯:财报电话会里的双重规避

语音情感识别 | 6.2/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9247 字 阅读 →
论文解读

别只看那一刻有多自信,要看一路有多摇晃:TRACE 用轨迹来判断情感是否可信

音视频理解 | 7.7/10

 · 更新于 2026-09-24 · 约 20 分钟 · 9757 字 阅读 →
论文解读

不只给一个抑郁概率:把声音拆成四条可审计的 DSM-5 线索

语音情感识别 | 7.1/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7092 字 阅读 →
论文解读

Adaptive Hierarchical Representation Alliance for Multimodal Learning

语音情感识别 | 8.6/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4966 字 阅读 →
论文解读

Do SpeechLMs Hear Their Own Opinions? Diagnosing and Mitigating Previous-Belief Contamination in Streaming Emotion Understanding

语音情感识别 | 8.9/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4535 字 阅读 →
论文解读

Dual-Scale State-Space Modeling with Speaker-Wise Dynamic CRF for Speech Emotion Recognition in Conversation

语音情感识别 | 8.4/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4585 字 阅读 →
论文解读

Represented but Ignored: A Causal Account of Prosodic Underuse in Audio-Language Models

音频理解 | 7.2/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6022 字 阅读 →
论文解读

Robust Incomplete Multimodal Sentiment Analysis via Iterative Proxy Correction

语音情感识别 | 5.4/10

 · 更新于 2026-09-24 · 约 12 分钟 · 6000 字 阅读 →
论文解读

Closing the Affective Loop: Multimodal Speaker-Listener Emotion-Dynamics-Aware Empathetic Social Robots

语音交互 | 6.5/10

 · 更新于 2026-09-24 · 约 8 分钟 · 3605 字 阅读 →
论文解读

Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models

音视频理解 | 7.4/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5996 字 阅读 →
论文解读

SpeechSense: A Paralinguistic-Focused Dataset for Fine-Grained Speech Sentiment Analysis

语音情感识别 | 8.5/10

 · 更新于 2026-09-24 · 约 7 分钟 · 3361 字 阅读 →
论文解读

Iterative Self-Learning for Expressive Text-to-Speech Synthesis

语音合成 | 6.1/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7178 字 阅读 →