把声音铺在身体周围:以可导航的语料库建造超环境
该文以四个舞蹈配置研究如何把预分析音频语料分布到舞者周围的虚拟体中并用动作做最近邻提取,最具体的证据是共享大体量与手部小体量在单元数与速度上的对照,代价是正式成片采用离线合成因而缺少实时演奏反馈。
该文以四个舞蹈配置研究如何把预分析音频语料分布到舞者周围的虚拟体中并用动作做最近邻提取,最具体的证据是共享大体量与手部小体量在单元数与速度上的对照,代价是正式成片采用离线合成因而缺少实时演奏反馈。
该文用离线描述符分析加四种可堆叠查询在 Max/MSP 里动态形成空间化声音组,并以四组共用 150 个声源的固定媒体作品验证流程,其代价是离线分析耗时、堆叠与动态查询受限和空间化带来的 CPU 压力。
该研究把木薯淀粉生物塑料做成不规则触摸面,用 8 电极电场层析扰动加支持向量机分类代替图像重建,在圆形样品与 55 厘米半球壳上验证了中等分辨率触摸词表的一小时稳定与 48 小时漂移代价,最终为一个月展期的低分辨率声音装置选择了保守映射。
该文把节奏同步建模为单反射点 IPF 对外部点击轨的逐拍跟随问题,用人工阶跃、线性、正弦与噪声点击轨检验同步、过冲与多节奏锁定范围,代价是存在明显相位差和过渡振荡且只用受控仿真而非真人合奏验证。
论文要解决高层作曲组织与底层实时 DSP 长期分离的问题,选择全部用 Common Lisp 重建调度、合成、记谱与界面,最强证据是同一 Lisp 映像内改 UGen 与预设并即时发声,代价是依赖 Incudine 与 CLOG 等外部生态且无受控定量评测。
该文在 FME-24 上比较手工特征 k-Means 与 VaDE 加对比学习的情感检索,前者聚类更紧致而后者支持按坐标连续取歌,但两类结果都受样本少与情感区间压缩的限制。
针对 CTC 对时间边界不敏感导致词结束时间常被拖到下一词起点的问题,该文在 CTC 之外只在词起点、词终点和静音等关键帧上加掩码交叉熵约束,用 Jamendo 上词起点平均绝对误差 0.213 秒、词终点 0.332 秒的对照显示全静音掩码改善终点、起点掩码决定起点,代价是起终点最优解来自两种掩码的组合而非单一模型。
该研究把飞利浦馆重建为九片直纹面并提取线与点来驱动弦乐滑音、五个能量块与稀疏铜管木管事件,最强的可核对证据是 36 条弦乐线与 3357 个采样点的确定性构造,代价是均匀插值难以保留局部曲率与统一配器难以推广到其他风格。
该研究以贝多芬第七与柴可夫斯基第五的 55 加 71 个演奏版本为对象,用声学特征加 VGGish 嵌入与五种元数据分组加戴维斯博尔丁指数检验相似性来源,最强证据是指挥主导速度响度而乐团在特定乐章主导音色,代价是录音环境未统一与因果解释仍需专家验证。
Gestalt 针对 50-200 人实时共演的参与门槛与延迟问题,采用浏览器端边缘计算加双层异构架构与活动加权聚合,在本地单机实验室压力测试中报告 200 人稳定与约 60 毫秒端到端延迟,代价是公网隧道下稳定上限降至 80 人且未经过大规模公演验证。
该文把作曲家定义的文本语料经语义嵌入、降维与量化压缩为可枚举的卦象状态,用以配置数字乐谱的结构条件而非生成声音,并以五句雨诗得到离散对偶输出的艺术实例展示其可解释与可重复的即兴逻辑,其代价是降维随机性带来的状态不稳定性。
Hyponoia 针对开放形式电声即兴中生理信号如何参与音乐形式的问题,用 Muse 2 四通道脑电加心率的闭环状态机把神经振荡映射为作曲过程,并在 4 人大小提琴与小号对比中显示声音实践专家有更丰富连贯的 theta 与 alpha 活动,代价是样本极小且阈值与伪迹处理未经充分验证。
本文以 Udio 生成物为语料提出潜音乐概念,用插值与再领土化解释阈限声音如何产生,并以两组可复述的提示装配与扩展操作展示其听感与代价是身份悬置与不可重复。
论文以 2021 年为波伦-皮尔斯单簧管与电子音乐而作的 Linear A 为对象,用 bach 可视化与约束微分音高、用标记驱动卡农与量化、用 MuBu 分段与 SuperVP 重排加 Antescofo 跟谱串起构思到演出,最强证据是同一套标记同时生成乐谱与实时指令,代价是全流程依赖特定 Max 生态与手工校准且无定量对照。
该研究用 2 阶录制加 3 阶解码把 5 段自然声景放在实验室与博物馆的 16 只 Genelec 阵列上对比,报告显示存在感较稳而深度、包围感、清晰度与稳定性在混响展厅中下降,代价是房间与垂直阵列构形混在一起无法分离。
该研究把东斯拉夫仪式布的象征构图与早期磁芯存储的穿线逻辑做到墙面大小的纺织装置上,用手持电磁感应线圈贴近游走读取磁起伏并映射为声音,代价是主动保留噪声与不稳定性,且全文未报告定量听感或系统性能指标。
MBHD 针对多来源循环难以同时对齐速度与调性的问题,用文件名编码的速度、根音与乐器角色驱动四路独立播放与实时变调变速,并在 Max 8 原型上报告约 5 ms 环路延迟、低于 20% 的满载 CPU 与 86.3 的可用性评分,代价是仍依赖人工改名与 12 平均律假设。
针对头显加耳机造成使用者与同室他人隔绝的问题,MetaConcert 选择 WebXR 播放 360°视频加 SuperCollider 播放预解码三阶 Ambisonics 穹顶声场的分流架构并用 OSC 桥接同步,在约 10 分钟节目上经感知验证同步可用,代价是仍依赖中央听音点、局域网质量与人工校准。
该工作把文王法起卦的偶然性放在投掷阶段、用规则加概率做实时伴奏,再把本卦之卦与动爻的经文交给大语言模型做针对性解读并转写成音乐提示词驱动生成模型,其代价是未做定量听感评估且生成音乐对细粒度语义提示不够敏感。
作者针对 2025 年 IEEE Big Data AI 音乐生成研讨会音乐比赛的浅层话语,用两人气鸣乐器在 GPU 机房的约一小时现场表演与录音构成抵抗行动,报告显示作品最终因赛后追加的 AI 方法与时长限制而落选,而代价是高参会费与规则不透明使抗议难以进入正式评审。