论文解读

不模仿鸟叫而是学会鸟的语法:亚马孙 transmorphic 音乐如何重排技术与生态的关系

论文以 2021 年专辑《Amazônia Verde Viva》与 2024 年对 Thiago 的访谈为证据,说明先解码动物发声结构再作曲的 transmorphic 路线,并以常用音频软件的挪用讨论技术殖民与多物种共作的代价与边界。

 · 更新于 2026-09-24 · 约 24 分钟 · 11641 字 阅读 →
论文解读

用文件名管住调性与速度:MBHD 的四轨循环表演系统

MBHD 针对多来源循环难以同时对齐速度与调性的问题,用文件名编码的速度、根音与乐器角色驱动四路独立播放与实时变调变速,并在 Max 8 原型上报告约 5 ms 环路延迟、低于 20% 的满载 CPU 与 86.3 的可用性评分,代价是仍依赖人工改名与 12 平均律假设。

 · 更新于 2026-09-24 · 约 22 分钟 · 10577 字 阅读 →
论文解读

不追求弹准的乐器:当身体、织物与声音互相谈判控制权

针对可穿戴电子纺织乐器中控制与能动性如何协商的问题,作者用四件套肠状织物传感界面与四名女性参与者的四阶段探索性实验,报告了从手控到全身协调、情感化解读与开放映射下持续协商的证据,代价是样本小、不可泛化且映射不可精确复现。

 · 更新于 2026-09-24 · 约 23 分钟 · 11168 字 阅读 →
每日研究速递

nime-2026 论文深度解读

共收录 160 篇 nime-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 332 分钟 · 166159 字 阅读 →
论文解读

被用力拉扯才算过关:触角织物乐器十五年的现场筛选史

论文以触角织物乐器家族十五年超 110 场公演为现场,研究身体导电与压力传感两条路线如何被佩戴位置、接缝工艺和映射可读性反复筛选,最强证据是同一声音引擎下几乎每天维修的 E1 与接待约 85000 人仅换 8 条触角的 E2 对照,代价是放弃需要学习的复杂合成控制。

 · 更新于 2026-09-24 · 约 23 分钟 · 11063 字 阅读 →
论文解读

共享轨迹与独占声对象:WeSp 如何把协作式空间化拆成可同时编辑的结构

针对沉浸式音频中轨迹编辑多为单用户、难以共享操控的问题,WeSp 把可共同修改的共享轨迹与每人独占的声音对象分开,并用 4 组共 16 人的协同任务与问卷显示可用性为正向,但密集交互下仍存在听觉区分难与视觉依赖重的代价。

 · 更新于 2026-09-24 · 约 19 分钟 · 9135 字 阅读 →
论文解读

拿掉按钮和屏幕之后:用动作模糊换取可探索性的手持环境声音盒

SonoCube 把 70mm 立方体作为全部界面,用触摸触发旋律、用朝向选择音高、用摇晃与旋转调制混响延迟滤波,并以约 10 人每次 5 至 7 分钟的非正式演示报告了触摸难发现与持续动作更易投入的观察,代价是触摸发现率低与重力触发路径约 107 ms 延迟。

 · 更新于 2026-09-24 · 约 23 分钟 · 11070 字 阅读 →
论文解读

从面包板到舞台:用对齐与独立乐器逼出可演奏的交互音乐系统课

该课程以建构对齐组织翻转课堂与 Bela 加 Pure Data 工具链,用 11 个工作坊和 8 个作业支撑独立可演奏乐器,报告 2022 至 2024 年 26 人中 25 人通过且 64% 获 A 至 B,但工作量与制作仍是主要代价。

 · 更新于 2026-09-24 · 约 24 分钟 · 11528 字 阅读 →
论文解读

不用电也能演奏:气压回路如何同时成为乐器、乐谱与演奏者

针对无电子器件的气动乐器设计问题,论文用模块化气压回路与哨子发声实现旋律与自主节奏,并以 10 人动手实验显示键盘易学而振荡器难预测,代价是共享气源互相干扰与高频音色局限。

 · 更新于 2026-09-24 · 约 20 分钟 · 10004 字 阅读 →
论文解读

不逐个试听,如何在 FM 参数海里找到想要的声音:VibeFM 的采样加可视总览

针对 DX7 类 FM 合成 144 参数空间难手动探索的问题,VibeFM 用 38 参数受控采样加 MFCC 相似度降维总览与四种字形辅助听觉想象,案例显示约 180 分钟做出 6 种声音并带来意外发现,代价是小样本定性评估与外部合成器带来的插值不平滑等限制。

 · 更新于 2026-09-24 · 约 20 分钟 · 10009 字 阅读 →
论文解读

看不见的空气如何被听见:用身体移动演奏污染数据的集体聆听装置

该文以麦德林空气污染为问题,用三天工作坊沉淀的呼吸录音与 PM2.5 历史数据,结合 Pure Data 与 BELA 的八路接近传感加拍手检测与双层扩声,证明多人移动能共同改变声音,最强证据是观众把空间描述为肺与琴,代价是交互初识门槛高且无定量听感评估。

 · 更新于 2026-09-24 · 约 21 分钟 · 10342 字 阅读 →
论文解读

把每一步变成声音:智能鞋如何同时处理冻结步的急救与步幅的慢训练

针对帕金森步态中冻结步突发与步幅缩小需长期训练的问题,该研究用足部边缘计算加网页蓝牙开发套件实现一步一鼓与随步幅开花的两套音乐反馈,在仅两例的试点中报告转弯冻结时长从 42.0 s 降至 2.3 s、交互期步幅显著上升,但样本极小且顺序未平衡,长期效果待验证。

 · 更新于 2026-09-24 · 约 24 分钟 · 11724 字 阅读 →
论文解读

把黑盒打开演奏:用网页可视化让 MDRNN 从工具变成应答伙伴

该研究为呼叫应答式演奏搭建了覆盖记录、组集、训练到表演的网页界面,用双路实时可视化暴露混合密度循环神经网络状态,5 人 40 分钟探索性研究显示系统可用性量表均值 62.50 分而视觉反馈清晰度达 4.0/5 分,代价是新手仍需面对模型训练的概念负担与小数据下生成质量不稳。

 · 更新于 2026-09-24 · 约 21 分钟 · 10458 字 阅读 →
论文解读

把舒服吹奏对准同一中点:围绕长时舒适的呼吸归一化

针对老年用户吹气能力差异导致高音量区够不着或维持不住的问题,该文用舒适呼吸对准 U=50、个性化上边界对准 U=100 的非线性归一化把不同绝对压力映射到同一 0-100 任务空间,两名 63 岁被试的试点显示同一长音目标带可被共同解释,但样本仅 2 人且单次会话不支持推广。

 · 更新于 2026-09-24 · 约 19 分钟 · 9139 字 阅读 →
论文解读

没有演员时,空间如何被声音演奏:五个区域的叙事乐器与教学复盘

该研究把地下室改造成无演员的声音戏剧,让观众以移动和操作发声道具推进五区叙事,用分布式传感加多通道音频加人工兜底实现可演出的闭环,并在三天 20 余场公演中验证了混合人工干预的必要性,代价是无线遮挡与暗光线索易造成卡顿。

 · 更新于 2026-09-24 · 约 21 分钟 · 10435 字 阅读 →
论文解读

既在远方又在此处:把延迟当约束的共享控制器工具包

论文要解决多人异地同玩一个乐器的问题,选择用中央服务器加网页协议共享控制状态,并用三场真实搭建的演出播客与桌游验证可行性,代价是不追求低延迟和固定配置限制了灵活扩展。

 · 更新于 2026-09-24 · 约 20 分钟 · 9985 字 阅读 →
论文解读

不靠听觉合奏:把振动、触摸和视觉当作音乐材料的即兴装置

Audionce 针对聋人与听人共同即兴时听觉门槛过高的问题,选择把物理扬声器阵列与点云虚拟镜面放在同一交互场中,用身体移动与触摸扬声器驱动声音与视觉,最强证据是聋人设计者与听人可协同完成结构化即兴而不被察觉听力差异,主要代价是振动难以分辨音高与音量等细粒度差异且依赖持续学习与视觉补偿。

 · 更新于 2026-09-24 · 约 24 分钟 · 11966 字 阅读 →
论文解读

不用调音台,只看参考录音:笔记本如何告诉吉他手该调大还是调小

针对没有调音师的小场地演出调音问题,SoLAR 用参考录音学理想混音并给出吉他音量建议,仿真显示硬编码策略能把增益误差收敛到参考附近,代价是仅验证了吉他音量且现场只做了两人试用。

 · 更新于 2026-09-24 · 约 20 分钟 · 9640 字 阅读 →
论文解读

把节奏写成代码再走成地图:BeatMohan 交响曲如何支架化模式组织

该文把基于模式的现场编码做成二维解谜游戏的核心操作,用代码、声音与角色移动三种同步表征支架化时机、重复与分层,5 人单次 45-60 分钟试玩显示组织更 deliberate,但无对照与可推广性声明。

 · 更新于 2026-09-24 · 约 18 分钟 · 8718 字 阅读 →
论文解读

不用直接拖舌头位置:用弹簧力产生平滑的双元音舌轨迹

针对几何直拖难以产生平滑非线性双元音轨迹的问题,论文用二维弹簧-质量-阻尼器把键盘输入映射为作用力再耦合 Pink Trombone 合成, pilot 显示曲线轨迹的弯曲能量由 1191.1 降到 211.6 而直线定位精度基本相当,代价是样本仅为作者且未做统计检验。

 · 更新于 2026-09-24 · 约 17 分钟 · 8355 字 阅读 →