先声还是先画:扩展现实视听乐器如何被设计出来
该文把同时实时生成三维图像与声音的扩展现实视听乐器定义为研究对象,用九维框架梳理 13 件已有乐器,并以同一原型分化出的声音优先与视觉优先两件乐器、5 个月协作自我民族志说明模态间映射与空间使用如何主导设计分化,其代价是观众维度与协作维度未被实测。
该文把同时实时生成三维图像与声音的扩展现实视听乐器定义为研究对象,用九维框架梳理 13 件已有乐器,并以同一原型分化出的声音优先与视觉优先两件乐器、5 个月协作自我民族志说明模态间映射与空间使用如何主导设计分化,其代价是观众维度与协作维度未被实测。
该研究把飞利浦馆重建为九片直纹面并提取线与点来驱动弦乐滑音、五个能量块与稀疏铜管木管事件,最强的可核对证据是 36 条弦乐线与 3357 个采样点的确定性构造,代价是均匀插值难以保留局部曲率与统一配器难以推广到其他风格。
Gestalt 针对 50-200 人实时共演的参与门槛与延迟问题,采用浏览器端边缘计算加双层异构架构与活动加权聚合,在本地单机实验室压力测试中报告 200 人稳定与约 60 毫秒端到端延迟,代价是公网隧道下稳定上限降至 80 人且未经过大规模公演验证。
针对传统 cuíca 音色扩展受限于双手演奏的问题,Hypercuíca 用绑在鼓身的手机重力传感器驱动 Ableton Live 效果器,在四场公开演出与工作坊的非正式反馈中显示出声场可变性增强,但代价是映射透明度下降与长时间独奏易耗尽新颖性。
论文以 2021 年为波伦-皮尔斯单簧管与电子音乐而作的 Linear A 为对象,用 bach 可视化与约束微分音高、用标记驱动卡农与量化、用 MuBu 分段与 SuperVP 重排加 Antescofo 跟谱串起构思到演出,最强证据是同一套标记同时生成乐谱与实时指令,代价是全流程依赖特定 Max 生态与手工校准且无定量对照。
该研究把东斯拉夫仪式布的象征构图与早期磁芯存储的穿线逻辑做到墙面大小的纺织装置上,用手持电磁感应线圈贴近游走读取磁起伏并映射为声音,代价是主动保留噪声与不稳定性,且全文未报告定量听感或系统性能指标。
MBHD 针对多来源循环难以同时对齐速度与调性的问题,用文件名编码的速度、根音与乐器角色驱动四路独立播放与实时变调变速,并在 Max 8 原型上报告约 5 ms 环路延迟、低于 20% 的满载 CPU 与 86.3 的可用性评分,代价是仍依赖人工改名与 12 平均律假设。
针对头显加耳机造成使用者与同室他人隔绝的问题,MetaConcert 选择 WebXR 播放 360°视频加 SuperCollider 播放预解码三阶 Ambisonics 穹顶声场的分流架构并用 OSC 桥接同步,在约 10 分钟节目上经感知验证同步可用,代价是仍依赖中央听音点、局域网质量与人工校准。
共收录 160 篇 nime-2026 会议论文的 Reader 深度解读
针对多声部各自保持独立拍号又需周期性对齐的多层节拍现场编程问题,OrbitScore 用 beat(n by m) 直接对应 4:(n/4) 理论并以独立循环加 SuperCollider 合成实现,50 分钟公开演出验证了 4:4/5:4/7:4 可实时修改与自动同步,代价是仅 macOS、只做采样回放且不能听外部声音自适应。
Oscilla 把 SVG 谱面同时做成记谱、控制器与音频触发层,用演奏头遍历、页面跳转、路径触摸与信号总线支持从作曲网络总谱到独奏星座即兴,代价是内置合成保持轻量、复杂声音必须依赖外部 OSC 合成且逆向自修改谱尚未进入创作实践。
论文用磁性墨把黑白条纹印在纸环上装入标准磁带壳,以普通卡座磁头直接检出磁变化发声,展览用五盘带子验证了无录音也能演奏,但手工印刷与磁化带来每盘独有的不稳定与不可录制性。
论文把 Pure Data 的数字信号处理对象改写为 C++ 类并保留同名调用逻辑,用噪声与振荡器等实例显示声音一致的改写路径,代价是不自带音频与 MIDI 硬件客户端且线程与内存需开发者自行处理。
PHOTON 针对羽管键琴等历史键盘的可变结构与狭小间隙,用键杠杆下方的反射式光学阵列连续测量位移,在约 1 cm 行程上给出约 100 级单调位置与超过 250 Hz 的子集采样,并以拨弦点附近的斜率变化推断发声时刻,代价是中间值为非线性插值坐标而非绝对几何量且需逐传感器校准。
该研究以室内篮球场实地录音为唯一主体材料,用颗粒拉伸、频谱变换、动态滤波与空间运动把运球、滑步、撞击转写为怀疑、挣扎与救赎的六段叙事,其代价是全程依赖感知判断而无可复测的定量指标与对照实验。
论文针对基于冻结自监督模型的音频伪造检测器提出无说话人依赖的线性卷积攻击 Malasimplex,在 YourTTS 与 XTTS 两组高质量伪造上把等错误率推高 2 到 7 倍,并在更换骨干时仍保持黑盒迁移,同时以频响曲线解释攻击在哪些频带掩盖伪造痕迹。
这篇工作室报告梳理 SARC 二十年以实践为基础的声音与音乐研究设施与方法,最强证据是声学实验室 84 只扬声器与多空间系统等可核对配置,代价是它不提供受控实验对比与可复用的训练式结论。
该文要解决图画谱面与演奏逻辑分离的问题,选择把演奏语义写进 SVG 元素标识符并由浏览器实时执行,依据是 Inkscape 绘制与浏览器解析的同一文档工作流,代价是未报告定量对照与延迟测量。
论文以智利混合音乐计算机 COMDASUAR 为对象,逆向还原其 Intel 8080 硬件与汇编软件协同,最强证据是逐字节原地逆行并修正滑音与终止符的子程序,代价是通用框图与音频路径尚未完全验证且无定量性能比较。
Solstice 以 40 分钟双人长形式回答如何在 NIME 中抵抗演示逻辑,用压力感应 Floors、增强低音提琴 Theresa 与卷积虚拟声学 CAVIAR 等稳定乐器加临时物件在 CCRMA 舞台上经一周排练形成关系性聆听结构,代价是强场地依赖与难以直接移植。