eusipco-2026 论文深度解读
共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读
共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读
论文用动作捕捉配对即兴音乐训练个人化动作到音乐系统,以两阶段压缩加跨模态预测实现实时生成,最强证据是域内重建与分布对齐可用但域外泛化与声码器质量仍是主要代价。
论文报告在巴西累西腓 Paço do Frevo 为期两周驻留中四位音乐舞蹈艺术家探索可穿戴乐器 Giromin v0.5 的过程,用六次访谈的反思性主题分析提炼六个主题,最强证据是双重音乐舞蹈能力构成结构性准入,而代价是 Max 补丁的集中式改参流程反复打断具身探索状态。
该研究把演出中实时声音做音高检测并每轮生成 12 度动态音阶去重调键盘、合成与房间反馈,其最强证据是两年现场与房间反馈系统的可演奏性,代价是调音映射不稳定且无定量听感或稳定性评估。
该文把音乐风格迁移拆成视觉文本联合定风格与色度约束保旋律两件事,用无反演流直接搬运隐变量并以内层梯度拉回音高结构,代价是旋律锚定越强时目标风格贴合会轻微下降。
该文要解决固定映射跟不上舞者个体与动作质感变化的问题,选择把动作变分自编码器编码器与 RAVE 音频解码器冻结后只学一个轻量对齐层并由舞者二值反馈门控更新,探索性会话显示连续性动作的感知连贯性有所改善而重音与停顿仍常失配。
该研究以 18 个月的共创即兴 In The Round 为问题载体,选择文化模式与诗歌总谱加 AirSticks 迭代校准的方法,最强证据是 4 名残障独奏者、3 名引导者与 10 名打击乐手在约 50 分钟七段式围圈演出中实现自主进出,最大的代价是高度依赖长期在场与灵活排期而难以压缩复制。
iXeRemin 针对 Apple Vision Pro 用右手管音高与触发、左手管音量音色与和弦选择,并以频率调制合成与指尖标签和开放声音控制输出实现可复现的触空复调演奏,其代价是依赖特定头显硬件且本文未做演奏者可用性评估。
Layika 针对独唱练习缺少现场塔布拉伴奏的问题,把拇指点手指的传统数拍动作直接映射为离散鼓声触发,在 4 名受训歌手的探索性试验中表现出熟悉易学和拍感增强,但受限于误触发、合身差异与只能演奏标准 Bol 的表达上限。
论文要解决环回频率调制带来持续基频偏移、使时变延迟函数随时间线性增长而无法装进环形缓冲的问题,选择用闭式解给出的解析相位和发声频率构造可回绕延迟并叠加整周期偏置,最强证据是回绕点相位连续且整周期偏置下波形不畸变,代价是必须预先知道发声频率且每隔 N 样本回绕一次。
Manubrio 针对离散映射割裂身体努力与声音结果的问题,选择三自由度把手连续控制可超 1 反馈增益的改进 Karplus-Strong 与延迟频率调制合成,四名乐手的质性研究显示它能支持从不适到融入的具身过程,代价是自振荡阈值附近需要极高精度且易因人体工学问题退回客体意识。
论文用 Mores 实测的 65 把吉他桥柔量与桥到空气辐射驱动几何精确非线性弦,在连续级做标量辅助变量二次化并以两次 Sherman-Morrison 秩一更新实现每步显式推进,以全品格约 6240 个音展示乐器相关共鸣,代价是琴体与辐射仍为线性模态且跨琴响度依赖两遍归一化。
该研究把现场编程的共享文本缓冲作为舞台,用三斜线指令召唤多个逐字打字的可见智能体并以冲突无关复制数据类型维持并发一致,再用检索增强保证 Strudel 语法可用,作者自研究显示角色转向策展与协商但伴随认知负荷与失控失效。
针对夜晚户外太暗导致常规增强现实无法跟踪的问题,nocturneAR 用发光体的颜色闪烁序列传递编号来触发画面与声音,2026 年 2 月 11 日的夜间森林探索性展览显示参与者会放慢移动并靠听觉叠加声音,但系统在明亮环境下不稳定且未做定量评估。
nOdes 为社区合奏设计 24 个手持球体与 50 Hz 服务器集中控制环,用重力向量选十二音高类别并接入外部生成系统实证,以 10.6 微秒级发包抖动换来可热重载的映射迭代能力,代价是 20 球以上丢包陡增与近距离饱和干扰。
针对只有音乐无法做空间与风格精细控制的问题,论文用 100.26 小时多模态 OpenDanceSet 与解耦词元加联合掩码预测的 OpenDanceNet 实现音乐加文本加关键点加轨迹的任意组合生成,在 AIST++ 与 OpenDanceSet 上取得更优保真与节拍对齐,但精修带来保真指标与物理指标的权衡。
Orbis 要解决如何把人工细胞中 Min 波的反应扩散动力学变成可作曲的光声运动,方法是按设定化学配比合成人工细胞并用图像跟踪把波位置转为环形声光定位,已在展览系统中实现三条件与三序列的对应呈现,代价是当前依赖预录视频且复现需要专门生物实验条件。
OTIAC 针对反馈增强古典吉他,用在线自组织映射学音色词汇、用因子预言机学生成序列并经换能器回注琴体,证据来自 9 个月与 H[t] Duo 的练习主导研究,代价是语料只限当场反馈、长时易重复且演奏者感知不对称。
论文把色度向量上的调性区间向量改写为可逆算子,用感知加权置换做对齐、用四五度圈上的循环最优传输做插值,并以圆柱几何分解音阶的根音、密度与色彩,代价是平滑表示不再保证非负且最优传输仍要求非负输入。
针对社区合奏中运动障碍乐手的表达与照护后勤矛盾,该研究用可调硬度的 TPU 晶格加非接触霍尔传感与星形无线音频链实现约 7 毫秒端到端延迟,但开放式可拆洗结构与 2.4GHz 拥挤仍是代价与边界。