每日研究速递

icmc-2026 论文深度解读

共收录 60 篇 icmc-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 123 分钟 · 61526 字 阅读 →
每日研究速递

speechprosody-2026 论文深度解读

共收录 188 篇 speechprosody-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 360 分钟 · 180081 字 阅读 →
论文解读

不做提示词混音:在神经音频编解码器的潜空间里直接捏合声音对象

针对端到端生成把创作压缩到提示词层的问题,该文选择对神经音频编解码器的量化音频潜嵌入做带时变系数的加权求和感知 morphing,用作品《龢》三阶段与五种编解码器对照验证可行性,代价是解码器鲁棒性与实时性等条件仍未被系统测量。

 · 更新于 2026-09-24 · 约 20 分钟 · 9850 字 阅读 →
论文解读

用一个非线性迭代跟住人:IPF 如何把节奏同步做成可复现的响应过程

该文把节奏同步建模为单反射点 IPF 对外部点击轨的逐拍跟随问题,用人工阶跃、线性、正弦与噪声点击轨检验同步、过冲与多节奏锁定范围,代价是存在明显相位差和过渡振荡且只用受控仿真而非真人合奏验证。

 · 更新于 2026-09-24 · 约 20 分钟 · 9721 字 阅读 →
论文解读

音高敏感跨母语起作用,节奏敏感却分母语:德法韩学习者感知西班牙语重音

研究用三选一重音辨别任务和 Mini-PROMS 四个音乐感知维度比较 20 名德语、20 名法语、20 名韩语中高级西班牙语学习者,发现德语组正确率最高且只有旋律分跨母语显著预测重音辨别,重音分与母语交互但组内均不显著,调音与速度均无显著效应。

 · 更新于 2026-09-24 · 约 17 分钟 · 8411 字 阅读 →
论文解读

不以控制为目标:班多钮琴边缘声响如何成为可演奏的共治线索

该文以独奏班多钮琴加现场电子与机器学习为对象,提出边缘声、姿态残留与被舍弃声三组声音痕迹作为行动线索,报告微弱气声与机械噪声比主导音高更稳定可辨,最强证据来自两场实验室式演出中的持续调校,代价是放弃通用识别精度与可迁移的定量评估。

 · 更新于 2026-09-24 · 约 23 分钟 · 11499 字 阅读 →
论文解读

几乎但又不是:在文本到音频的潜空间里听见未成形的音乐

本文以 Udio 生成物为语料提出潜音乐概念,用插值与再领土化解释阈限声音如何产生,并以两组可复述的提示装配与扩展操作展示其听感与代价是身份悬置与不可重复。

 · 更新于 2026-09-24 · 约 20 分钟 · 9743 字 阅读 →
每日研究速递

nime-2026 论文深度解读

共收录 160 篇 nime-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 332 分钟 · 166159 字 阅读 →
论文解读

空间聆听作为方法:从听觉定位到生态与参与式声音实践

该文把空间聆听界定为连接听觉生理、现象学与社会政治的具身关系实践,以三件作者作品为线索串联理论,最强证据是文献与创作过程的对应说明,代价是未提供可重复测量的实验数据与对照。

 · 更新于 2026-09-24 · 约 18 分钟 · 8794 字 阅读 →
每日研究速递

dafx-2026 论文深度解读

共收录 91 篇 dafx-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 181 分钟 · 90282 字 阅读 →
每日研究速递

eusipco-2026 论文深度解读

共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 247 分钟 · 123292 字 阅读 →
论文解读

把泛音列织进墙面:用走位而非旋钮演奏固定磁场

该文把奇次泛音地形织进墙面尺度纺织品并用手持感应环读取,其证据是 44 磁体由 25 路复用驱动与 72 赫兹基频折叠方案,代价是静止无声且需身体走位学习路线。

 · 更新于 2026-09-24 · 约 20 分钟 · 9733 字 阅读 →
论文解读

把不稳定反馈握在手里:Manubrio 如何用持续身体调节换取乐器透明性

Manubrio 针对离散映射割裂身体努力与声音结果的问题,选择三自由度把手连续控制可超 1 反馈增益的改进 Karplus-Strong 与延迟频率调制合成,四名乐手的质性研究显示它能支持从不适到融入的具身过程,代价是自振荡阈值附近需要极高精度且易因人体工学问题退回客体意识。

 · 更新于 2026-09-24 · 约 20 分钟 · 9629 字 阅读 →
论文解读

把感知显著性压进粗结构:噪声增强自编码器如何对齐音乐表征

该文用带噪潜变量微调一致性音频自编码器加感知损失来学习由粗到细的感知层次,并用自回归整流流估计音高惊奇度,在重建保真、与 IDyOM 相关性和 EEG 预测上报告了提升,但干净重建略有损失且高噪声机制仍待验证。

 · 更新于 2026-09-24 · 约 19 分钟 · 9024 字 阅读 →
论文解读

把和声距离写进傅里叶权重:对齐与插值音高分布的可逆工具箱

论文把色度向量上的调性区间向量改写为可逆算子,用感知加权置换做对齐、用四五度圈上的循环最优传输做插值,并以圆柱几何分解音阶的根音、密度与色彩,代价是平滑表示不再保证非负且最优传输仍要求非负输入。

 · 更新于 2026-09-24 · 约 19 分钟 · 9179 字 阅读 →
论文解读

留住手感再连电脑:MidiMbira 如何把姆比拉调音逻辑搬进 MIDI

论文要解决传统姆比拉微分音调音难记录、难教学、难进数字流程的问题,选择保留琴体手感并叠加 MIDI 与 OSC 控制的混合改造路线,用两名演奏者的实测音分差异和现场装置验证可行性,代价是无受控听辨实验与延迟精度数据。

 · 更新于 2026-09-24 · 约 17 分钟 · 8202 字 阅读 →
论文解读

当按压力不再等于出声音:用感觉变弱来检验数字乐器的控制感

论文把自我归因的操作化为演奏时对响度的感觉减弱,用压力线性和时间记忆两种映射扰动检验它,结果显示只有大音量下出现预期的减弱方向,而映射主效应不显著且样本小、学习效应未分离。

 · 更新于 2026-09-24 · 约 19 分钟 · 9148 字 阅读 →
每日研究速递

aaai-2026 论文深度解读

共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 307 分钟 · 153423 字 阅读 →
论文解读

预训练会弹琴却不懂调式:把大/小调先验注入最弱层的情绪识别补课

针对 MIDIBERT 做符号音乐情绪识别时调式-情感关联缺失的问题,用 Krumhansl-Kessler 提取大/小调并以 FiLM 注入第一层,在 EMOPIA 达 75.2% 准确率、VGMIDI 达 59.1% 准确率,代价是只用二分类调式并依赖自动调式估计的正确性。

 · 更新于 2026-09-24 · 约 23 分钟 · 11071 字 阅读 →