论文解读

从一个人跳到一屋人跳:Encypher 把集体律动写成音乐提示

Encypher 研究陌生人如何一起跳舞并共同引导实时神经音频,用 11 人课堂研究显示协作感达 81.8% 认同而个人控制感仅 63.6%,代价是 2 秒生成延迟和屏幕分散注意力的双刃效应。

 · 更新于 2026-09-24 · 约 18 分钟 · 8986 字 阅读 →
每日研究速递

icmc-2026 论文深度解读

共收录 60 篇 icmc-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 123 分钟 · 61526 字 阅读 →
每日研究速递

jep-2026 论文深度解读

共收录 118 篇 jep-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 238 分钟 · 118878 字 阅读 →
每日研究速递

speechprosody-2026 论文深度解读

共收录 188 篇 speechprosody-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-24 · 约 360 分钟 · 180081 字 阅读 →
论文解读

用沙子的形状直接捏声音:连续变形材料如何绕开离散手势识别

该系统把沙面深度变化与沙盘小物件检测分别做成连续特征与离散切换令牌,再用多对多映射送入混合声音引擎,探索性使用显示无需乐理即可建立因果,但代价是细粒度手势易被淹没且单顶视相机存在遮挡中断。

 · 更新于 2026-09-24 · 约 17 分钟 · 8264 字 阅读 →
论文解读

不推断情绪,只演奏身体:生物反馈套件如何把映射当作作曲

该文把皮肤电、动作与面部表情当作可演奏的音乐材料,用 Python 中间件加 Pure Data 两阶段映射在键盘实践中检验,报告称离散受限映射更清晰、高层和声触发更连贯,代价是即时性下降与系统复杂、学习曲线陡峭。

 · 更新于 2026-09-24 · 约 21 分钟 · 10197 字 阅读 →
论文解读

在虚拟现实里一起打拍子:乐器与舞台为什么必须一起设计

该研究把协作节奏乐器与多人空间布局放在 PatchWorld 内共同设计,用 9 人两组迭代得出通用节奏盒与三人半圆分层舞台,并报告视觉反馈为主、归因模糊为关键代价的发现。

 · 更新于 2026-09-24 · 约 18 分钟 · 8967 字 阅读 →
论文解读

皮肤即接口:从旋钮到触碰,残障主导如何重写协作乐器的玩法循环

论文以七年四版 Bot Party 为线索,研究残障设计认识论如何把玩家间皮肤接触变成可检测、可奖励的核心机制,最强证据是触觉失效时参与迅速坍缩与触觉恢复后群体玩法的回升,代价是单设计师自述民族志与展览数据的可比性与泛化边界受限。

 · 更新于 2026-09-24 · 约 24 分钟 · 11867 字 阅读 →
论文解读

把削铅笔插进音箱:用不协调让日常动作变成演奏

该研究把卷笔刀嵌入吉他音箱与调音台并保留原有外观与旋钮操作,用削铅笔的摩擦振动经压电元件送入原输入链路作为声源,通过两次展览的质性观察显示违和感反而降低了参与门槛,但结论限于铅笔削笔这一特定动作而未做定量对照。

 · 更新于 2026-09-24 · 约 21 分钟 · 10136 字 阅读 →
论文解读

用坐标找配乐:手工聚类守住可解释基线,深度生成模型换来连续检索

该文在 FME-24 上比较手工特征 k-Means 与 VaDE 加对比学习的情感检索,前者聚类更紧致而后者支持按坐标连续取歌,但两类结果都受样本少与情感区间压缩的限制。

 · 更新于 2026-09-24 · 约 20 分钟 · 9590 字 阅读 →
论文解读

看不见的呼吸如何被看见:呼吸镜把钢琴演奏的身体感受变成可回看的时间线

针对钢琴演奏中呼吸隐蔽且难以精确回忆的问题,作者用纺织集成应变腰带同步记录胸腹呼吸与演奏数据并以事后可视化界面支持三重视角反思,在一位 35 年琴龄演奏者一个月四次会话中发现吸气锚定低音等耦合模式与主客观不一致的盲区,代价是单人个案尚不能推广到群体。

 · 更新于 2026-09-24 · 约 23 分钟 · 11242 字 阅读 →
论文解读

会用控制器还不够:为数字音乐熟手补上原型设计的一整轮

针对已熟练使用商用数字音乐工具但缺硬件原型能力的高年级本科生,论文用研究—搭建—作曲—演出—文档的全周期结构组织 15 周课程,在 16 人两学期中报告 15 人完成全流程、7 人建后改硬件,以小班与统一套件为代价换来持续迭代条件。

 · 更新于 2026-09-24 · 约 19 分钟 · 9414 字 阅读 →
论文解读

从触发器到同台者:MAD 单簧管四代迭代中的算法能动性是如何长出来的

本文以 MAD 单簧管为个案追踪其从被动触发到算法伙伴的四代演进,核心证据是 2.1 的单向视听触发、3.0 和声器与随机系统的实时改写、New Set 中马尔可夫链的即时再 elaboration,主要代价是每代都伴随噪声、重复与需人启动的局限。

 · 更新于 2026-09-24 · 约 23 分钟 · 11044 字 阅读 →
论文解读

把文本变成手码:TextCueS 如何让 LfPC 编码步骤可见可改

论文要解决从文本生成法语 LfPC/提示语编码的教学工具缺失问题,选择把生成引擎与语言规则分离并暴露三步可核对流程,其证据是已验证的生成引擎与用户测试过的界面,而代价是美式英语长元音三维动作在二维显示上尚未优化。

 · 更新于 2026-09-24 · 约 18 分钟 · 8652 字 阅读 →
论文解读

手势能画出声调吗:哼唱与手指轨迹为何趋同而带词朗读却偏离

该研究用平板正弦声调界面比较母语与零起点法语者在词汇朗读、哼唱、手势三种模态下对易混双音节三声的模仿,显示哼唱与手势高度重合而词汇朗读系统性偏离,支持先做无词段旋律练习再进入词汇训练,但固定顺序与小样本限制了因果推断。

 · 更新于 2026-09-24 · 约 16 分钟 · 8012 字 阅读 →
论文解读

不控参数而控过程:Hyponoia 把脑电状态变成作曲行为

Hyponoia 针对开放形式电声即兴中生理信号如何参与音乐形式的问题,用 Muse 2 四通道脑电加心率的闭环状态机把神经振荡映射为作曲过程,并在 4 人大小提琴与小号对比中显示声音实践专家有更丰富连贯的 theta 与 alpha 活动,代价是样本极小且阈值与伪迹处理未经充分验证。

 · 更新于 2026-09-24 · 约 21 分钟 · 10269 字 阅读 →
论文解读

在装置内部做研究:光学声片制作中的内在实践

论文以 11 位光学声电影人的访谈为材料,用转导、帧、差异、重复、化学五组装置结构做衍射式阅读,提出内在实践的特征,代价是结论依赖特定社群与手工条件而不追求可推广的量化验证。

 · 更新于 2026-09-24 · 约 21 分钟 · 10472 字 阅读 →
论文解读

把对话、主动发起与非言语表达压进一个提示驱动策略:基于 LLM 的工作流能否替代分离式规则

该研究把主动规划、口头对话与非言语通信统一为一个零样本提示驱动的 LLM 代理工作流,并在 Pepper 机器人上与基于规则的多策略基线对比,主动性离线重放占优而用户体验总体接近,但推理延迟与样本不均衡仍是主要代价。

 · 更新于 2026-09-24 · 约 17 分钟 · 8085 字 阅读 →
论文解读

抛球晚两秒才响:音乐杂耍如何记谱与仿真

针对铃球接住才发声带来的延迟与换球规划难题,论文用音乐 Siteswap 记谱加三维动画组件把整场演出算成可排练的事件序列,已能复现协奏曲等复杂曲目,但仍需补创作与训练环节的可用性验证。

 · 更新于 2026-09-24 · 约 21 分钟 · 10095 字 阅读 →
论文解读

想让人听懂时,说话人会更用力抵抗被扭曲的听觉反馈吗

该试点研究用实时上移第二共振峰的听觉反馈扰动检验可懂度需求是否增强听觉运动适应,在两名法语被试上未发现系统性效应,只在个别被试上看到与假设一致但不一致的趋势,且暴露了顺序与消洗不彻底的方法局限。

 · 更新于 2026-09-24 · 约 15 分钟 · 7247 字 阅读 →