黑暗不是故障:在夜林里把光同时当作路标、标记和乐器
针对夜晚户外太暗导致常规增强现实无法跟踪的问题,nocturneAR 用发光体的颜色闪烁序列传递编号来触发画面与声音,2026 年 2 月 11 日的夜间森林探索性展览显示参与者会放慢移动并靠听觉叠加声音,但系统在明亮环境下不稳定且未做定量评估。
针对夜晚户外太暗导致常规增强现实无法跟踪的问题,nocturneAR 用发光体的颜色闪烁序列传递编号来触发画面与声音,2026 年 2 月 11 日的夜间森林探索性展览显示参与者会放慢移动并靠听觉叠加声音,但系统在明亮环境下不稳定且未做定量评估。
该研究让 98 名新手用 MMM-Cubase v2 和 Calliope 完成 16 小节编配任务并测量可用性、体验与接受度,最强证据是两系统 SUS 均超 70 且未来使用意愿超七成,代价是控制深度不足、作者感低与透明度缺失。
OTIAC 针对反馈增强古典吉他,用在线自组织映射学音色词汇、用因子预言机学生成序列并经换能器回注琴体,证据来自 9 个月与 H[t] Duo 的练习主导研究,代价是语料只限当场反馈、长时易重复且演奏者感知不对称。
该研究用房间脉冲响应的自卷积夸张系统把场地声学变成可演奏的混响,在 7 场演出中以质性反馈和频谱分析显示可听声学特征更易引发对空间与人的觉察,代价是啸叫、浑浊与可懂度损失。
该文把欧几里得节奏与方向性旋律遍历做成可在 Pure Data 中多实例叠层的 MIDI 音序器,用两次第一人称即兴回答可演奏性问题,最强证据是双实例下手势与结果的即时可读性与四实例下受约束调制对复杂度的缓解,主要代价是复调层数增加带来的感知负荷与旋律多样性受限。
针对社区合奏中运动障碍乐手的表达与照护后勤矛盾,该研究用可调硬度的 TPU 晶格加非接触霍尔传感与星形无线音频链实现约 7 毫秒端到端延迟,但开放式可拆洗结构与 2.4GHz 拥挤仍是代价与边界。
该研究让人吹奏发声、机器人按 MIDI 驱动按键,用点头手势的速度双峰间隔乘固定比预测起始时刻,8 名长笛手对照显示手势条件增强同伴感与主导感而计时器条件时间更稳,代价是手势识别需夸张动作且视觉反馈效果不一致。
针对影视非语音非音乐音效在检索与程序化生成之间频繁切换的问题,QuAP 用混合检索加六个程序化模型加规则助手统一工作流,主证据是 16 人用户评估与 MUSHRA 在六类中五类显著改善和 FSD50K 上 MobileNetV3 检索占优,代价是 Rocket 与 Jet 等类别仍不够逼真且仅支持六类。
针对直线步进音序器割裂塔拉循环连续性的问题,RhythmTable 用 86 cm 圆形桌面加角度触发与视觉跟踪实现多人共置演奏,形成性观察显示陌生人可在数分钟内拼出对称多边形与复节奏,但遮挡与非结构化评估仍是主要代价。
Robo-Bend 针对电吉他推弦费力且依赖手指定位的问题,选择在琴头用舵机齿条直接顶弦并用脚踏控制,在 5 人对照中实现约 280 音分且与把位无关的稳定升高,代价是踏板行程与音高非线性导致瞄准困难与收敛变慢。
该研究把约 32 个键的指法与乐谱时序交给舵机与 MIDI 序列处理,人只负责吹气与口型,用 240 帧高速摄影测得平均约 25 ms 的按键延迟与 10 人听辨难区分的结果为证据,代价是固定速度播放、不处理细腻表情,且大管体需另做推杆结构与腰挂电池。
该文研究演出中实时重配动作到声音映射时的分工问题,用十天工作坊加两场约八分钟公演的单案例表明耦合环境把控制权在舞者与操作员之间重新分配,代价是基线可预测性必须保留且结论不可统计推广。
该研究用市售游戏手柄加本地 3D 打印辅助件加安卓开源应用解决无障碍乐器难以持续复制的问题,在印度北部非营利组织的 7 人部署中验证了可本地采购组装和约 15 分钟上手,但未做正式效果评估且存在音频格式与配件适配代价。
论文用四辆联网电动货运自行车组成可移动演奏系统,在亚特兰大 11 km 群骑中验证个人聆听、共在群体与城市环境三种声音互动尺度的切换,代价是无定量声学测量、依赖社区领骑保障安全且重型硬件仍需迭代。
该文以班加罗尔印度声音研究组织二十年实践为对象,提出把空间、工具、准入与治理当作作曲材料的方法,其证据是 32 通道空间音频实验室、工作坊谱系与衍生项目在约束与慢速生长中持续生成,代价是放弃可复制的通用模型与年度新颖性评价。
论文要解决传统姆比拉微分音调音难记录、难教学、难进数字流程的问题,选择保留琴体手感并叠加 MIDI 与 OSC 控制的混合改造路线,用两名演奏者的实测音分差异和现场装置验证可行性,代价是无受控听辨实验与延迟精度数据。
论文用轮廓复信号傅里叶分解做形状到音色映射,用面积做包络、用极坐标位置做混音,在键盘保音高时序下实现可重复的物件预置,代价是仅用二维剪影且边缘畸变与电平部分耦合。
论文要解决如何用带状控制器表现中国弦乐的滑音与微分音,方法是把田进勤 XK 系列形式化为左手连续音高加右手连续包络的交互模式并用碳膜与开源硬件重建 XK-S,最强证据是 3 毫米宽碳条在 223±21 千欧下获得可用线性与可演奏性,代价是每条传感器都需逐条校准且 MIDI 难以表达连奏手势。
针对无损完美循环压抑偶然与主动性的问题,Zen-PCB 用裸露印制电路板做皮肤与 5 行 3 列导电短接矩阵做输入,配合 16 颗粒 WSOLA 与处理后写回同一环形缓冲的破坏链路实现持续音蚀,最强证据是 15 人评价中享乐刺激达 0.98 而实用质量仅 0.55,代价是 22.05 千赫低保真与直觉优先于效率。
共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读