论文解读

不用存乐谱,只问时间:Uzulangs 把音乐模式写成时间的纯函数

论文把以 TidalCycles 为源头的现场编程家族改称为 Uzulangs,方法是用时间的纯函数加查询窗口表示模式,最强证据是查询、连接与可视化在多个语言中可复述,代价是放弃状态导致马尔可夫链等有状态写法很少被使用。

 · 更新于 2026-09-24 · 约 21 分钟 · 10215 字 阅读 →
论文解读

不逐个试听,如何在 FM 参数海里找到想要的声音:VibeFM 的采样加可视总览

针对 DX7 类 FM 合成 144 参数空间难手动探索的问题,VibeFM 用 38 参数受控采样加 MFCC 相似度降维总览与四种字形辅助听觉想象,案例显示约 180 分钟做出 6 种声音并带来意外发现,代价是小样本定性评估与外部合成器带来的插值不平滑等限制。

 · 更新于 2026-09-24 · 约 20 分钟 · 10009 字 阅读 →
论文解读

卡曼恰琴体为何上半球一变就变声:厚度与音孔的振动证据

论文以封闭背板卡曼恰独立音箱为对象,用轴对称有限元扫参与自由悬挂锤击测频响做对照,显示上半球加厚与音孔减半抬高中低阶模态而下半球几乎不动,并把 4、5、7 阶模态指为支撑 C 弦谐波放大的主要候选,但材料离散使定量对齐仍有超过 2 比 1 的偏差代价。

 · 更新于 2026-09-24 · 约 19 分钟 · 9273 字 阅读 →
论文解读

先抹掉再贴上:用颤音匹配把齐奏混音藏成一个声源

该文研究齐奏混音中不同颤音模式暴露多声源的问题,提出先抑制目标颤音再从源信号迁移频率调制与分谐波幅度调制加残差谱包络调制的方法,以声谱图示例和同命运变换分离失效为证据,代价是尚无听音实验与客观分离指标量化。

 · 更新于 2026-09-24 · 约 18 分钟 · 8865 字 阅读 →
论文解读

成就越高越心虚:用游戏规则把冒充者体验变成可演奏的失败

该作品把冒充者现象转写为三关网格游戏,用观众喊格、故障 tile 与成就和自信双计分来演奏自我怀疑,最强的可复述证据是三段软件流水线与足部追踪校准流程,代价是每关之间必须回起点做校准步且目前没有定量听众评估。

 · 更新于 2026-09-24 · 约 22 分钟 · 11020 字 阅读 →
论文解读

墙上的形状即乐器:用投影几何推断站位并门控离散音高的协作装置

该装置让 1 至 4 名表演者手持投影在 4 m×3 m 空间走动,用天花板相机只看墙上多边形的几何来判别 5 个空间交互点并驱动声音,离散音高经倾斜与置信度与连续帧门控后才切换,而连续音色保持约 30 fps 响应,代价是约 0.33 s 切换延迟与暗室和重标定依赖。

 · 更新于 2026-09-24 · 约 17 分钟 · 8312 字 阅读 →
论文解读

时变房间里用音乐做激励:可微分参数均衡为何要换掉时域误差

论文把自适应房间均衡做成闭环可微分控制,用 7 段参量均衡加频域误差在实测时变房间脉冲响应和音乐激励下跟踪目标响应,最强证据是频域目标相对未均衡把系统距离压低约 7 成而时域误差全配置不收敛,代价是对在线房间估计质量敏感且高阶优化器单帧耗时接近帧长。

 · 更新于 2026-09-24 · 约 24 分钟 · 11623 字 阅读 →
论文解读

可预测就电一下:用现场学习的惩罚迫使即兴演奏者不断换招

该研究针对无预训练的即兴场景,用声音与肌电的四个在线预测器判断演奏是否可预测并以电刺激惩罚,报告预测准确率约为随机猜测的 1.5 至 2.5 倍,代价是误报多、演奏者注意力被算法牵走且只在作者本人的电子乐器演出中验证。

 · 更新于 2026-09-24 · 约 23 分钟 · 11296 字 阅读 →
论文解读

把黑盒打开演奏:用网页可视化让 MDRNN 从工具变成应答伙伴

该研究为呼叫应答式演奏搭建了覆盖记录、组集、训练到表演的网页界面,用双路实时可视化暴露混合密度循环神经网络状态,5 人 40 分钟探索性研究显示系统可用性量表均值 62.50 分而视觉反馈清晰度达 4.0/5 分,代价是新手仍需面对模型训练的概念负担与小数据下生成质量不稳。

 · 更新于 2026-09-24 · 约 21 分钟 · 10458 字 阅读 →
论文解读

把舒服吹奏对准同一中点:围绕长时舒适的呼吸归一化

针对老年用户吹气能力差异导致高音量区够不着或维持不住的问题,该文用舒适呼吸对准 U=50、个性化上边界对准 U=100 的非线性归一化把不同绝对压力映射到同一 0-100 任务空间,两名 63 岁被试的试点显示同一长音目标带可被共同解释,但样本仅 2 人且单次会话不支持推广。

 · 更新于 2026-09-24 · 约 19 分钟 · 9139 字 阅读 →
论文解读

跟住键盘手而不是固定磁带:Accomplice 如何把跟谱、指挥与播放拆开做现场电子伴奏

Accomplice 针对键盘 MIDI 现场表演,用分离的跟谱指挥器加可分布播放器和拍号保留的时间调度来跟随真人演奏并输出 MIDI 与 OSC 或 O2 控制,在室内歌剧实测中多数预测误差集中在正负 50 毫秒内,代价是仍需人工处理延长、装饰音与左右手错位等边界情况。

 · 更新于 2026-09-24 · 约 23 分钟 · 11156 字 阅读 →
论文解读

把做乐器的扩散模型拿去换嗓:统一条件如何同时管住音高、音素与演唱者

论文把多乐器音乐合成的注意力扩散模型改造为语音与歌声转换,用音素后验、基频与演唱者嵌入做条件,在自然度与演唱者相似度上追平专用转换模型,但音素保真下降且加入器乐数据会拉低人声质量。

 · 更新于 2026-09-24 · 约 18 分钟 · 8901 字 阅读 →
论文解读

不用步进音序器:五个旋钮的差分如何长出切分,三个光敏电阻又如何捏住音色

该鼓机用五个旋钮的成对差分同时决定乐器选择与十六分音符休止数来生成非固定长度的确定性节奏,并用三个光敏电阻经平滑后控制调频合成的调制量与包络长度,代价是参数到节奏的映射难预测且需要外接效果器才能形成段落叙事。

 · 更新于 2026-09-24 · 约 23 分钟 · 11238 字 阅读 →
论文解读

把同步后的波形算成频谱搬移:加法合成做无混叠振荡器同步

针对硬同步直接重置相位会产生不连续和高频混叠的问题,论文用有限傅里叶系数经线性频谱重采样再做加法合成实现带限同步,并以 96 kHz 单音色 ASIC 在约 5 个音频采样内完成变换为代价换取实时性。

 · 更新于 2026-09-24 · 约 16 分钟 · 7664 字 阅读 →
论文解读

既在远方又在此处:把延迟当约束的共享控制器工具包

论文要解决多人异地同玩一个乐器的问题,选择用中央服务器加网页协议共享控制状态,并用三场真实搭建的演出播客与桌游验证可行性,代价是不追求低延迟和固定配置限制了灵活扩展。

 · 更新于 2026-09-24 · 约 20 分钟 · 9985 字 阅读 →
论文解读

从噪声中途上车:暖初始化让同一个扩散模型做音色迁移与音频修复

论文用暖初始化把预训练音频扩散模型的逆向过程从引导信号中途启动,以双簧管转钢琴等实验研究初始化时间与噪声比例的取舍,报告在杰卡德距离低于 0.6 且弗雷歇音频距离低于 0.7 附近存在可用工作点,代价是对人声与强打击乐等成分处理不稳定且依赖高引导强度等超参数。

 · 更新于 2026-09-24 · 约 21 分钟 · 10477 字 阅读 →
论文解读

不靠听觉合奏:把振动、触摸和视觉当作音乐材料的即兴装置

Audionce 针对聋人与听人共同即兴时听觉门槛过高的问题,选择把物理扬声器阵列与点云虚拟镜面放在同一交互场中,用身体移动与触摸扬声器驱动声音与视觉,最强证据是聋人设计者与听人可协同完成结构化即兴而不被察觉听力差异,主要代价是振动难以分辨音高与音量等细粒度差异且依赖持续学习与视觉补偿。

 · 更新于 2026-09-24 · 约 24 分钟 · 11966 字 阅读 →
论文解读

不用调音台,只看参考录音:笔记本如何告诉吉他手该调大还是调小

针对没有调音师的小场地演出调音问题,SoLAR 用参考录音学理想混音并给出吉他音量建议,仿真显示硬编码策略能把增益误差收敛到参考附近,代价是仅验证了吉他音量且现场只做了两人试用。

 · 更新于 2026-09-24 · 约 20 分钟 · 9640 字 阅读 →
论文解读

亲密与广袤之间:用骨传导耳机与穹顶扬声器写分层现场

该研究以骨传导耳机私密层加穹顶扬声器共享层加现场声源的三层现场为问题,用四部新作与作曲家自述对照出频带分工与层间关系策略,最强证据是录音仓储已公开可核对,代价是电平与注意力极易饱和且结论仍是作曲家报告而非大样本验证。

 · 更新于 2026-09-24 · 约 23 分钟 · 11254 字 阅读 →
论文解读

软硬难两全:用可缝合的柔性基板把压电鼓点穿在身上

针对身体打击乐需要压电传感器稳定安装又需要服装柔软贴身的矛盾,该研究用消费级三维打印柔性聚氨酯基板加背部嵌入式处理的方法制作马甲与手套,并在 2025 年两场公开演出中验证了可穿戴演奏的稳定性,其代价是以定性使用验证代替受控定量评估且声学映射完全开放给艺术家二次完成。

 · 更新于 2026-09-24 · 约 19 分钟 · 9106 字 阅读 →