论文解读

造循环器学信号处理:把录音、叠加与消咔哒声做成可跟做的课程

该文以在 Max、gen~ 与 RNBO 中逐步建造现场循环器为教学方法,让学生在录音播放、叠加与去咔哒声等真实音乐任务中学习缓冲与时序,课堂观察显示参与度和迁移能力提升,但 gen~ 与 RNBO 的转换仍受单学期时间与代码畏难情绪限制。

 · 更新于 2026-09-25 · 约 22 分钟 · 10835 字 阅读 →
每日研究速递

icmc-2026 论文深度解读

共收录 60 篇 icmc-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-25 · 约 123 分钟 · 61526 字 阅读 →
每日研究速递

jep-2026 论文深度解读

共收录 118 篇 jep-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-25 · 约 238 分钟 · 118878 字 阅读 →
每日研究速递

speechprosody-2026 论文深度解读

共收录 188 篇 speechprosody-2026 会议论文的 Reader 深度解读

 · 更新于 2026-09-25 · 约 360 分钟 · 180081 字 阅读 →
论文解读

穹顶之上的作曲笔:Zirkonium 如何把 47.4 通道的空间位置变成可写的参数

论文要解决的是作曲家无需技术人员即可在可变扬声器穹顶上精确定位与编排声音运动的问题,选择向量幅度平移加后期高阶环绕声的可移植路线,以三代软件迭代与上千场音乐会实践为证据,代价是长期依赖 macOS 与人工搭建调音链路。

 · 更新于 2026-09-25 · 约 19 分钟 · 9428 字 阅读 →
论文解读

先消掉空气声、再用滤波器重放:可独立控制堵塞增益与插入损失的耳罩装置

针对自己声音堵塞效应个体差异大、难以重复呈现的问题,该工作用大耳罩物理去除空气传导再经实时滤波重放,并在人工头上验证了对多档堵塞增益与插入损失组合的独立仿真能力,代价是低频仍有残余上限与约 6.5 ms 系统延迟。

 · 更新于 2026-09-25 · 约 19 分钟 · 9394 字 阅读 →
论文解读

为全身舞蹈保留发声逻辑:1978 年 Terpsitone 的交互式数字孪生

论文以 1978-1979 年为 Lydia Kavina 制作的最后一台 Terpsitone 为对象,用实测建模的三维体、范德波尔振荡器差拍的声音引擎和头手质心映射的交互链做可演奏的虚拟现实孪生,历史考证显示至少四代形态而音量映射始终多变,当前原型已能走通动作到声音但精度与稳定性仍待验证。

 · 更新于 2026-09-25 · 约 21 分钟 · 10467 字 阅读 →
论文解读

用沙子的形状直接捏声音:连续变形材料如何绕开离散手势识别

该系统把沙面深度变化与沙盘小物件检测分别做成连续特征与离散切换令牌,再用多对多映射送入混合声音引擎,探索性使用显示无需乐理即可建立因果,但代价是细粒度手势易被淹没且单顶视相机存在遮挡中断。

 · 更新于 2026-09-25 · 约 17 分钟 · 8264 字 阅读 →
论文解读

重叠喀哒声串归谁:三水听器加视频如何拆解抹香鲸近场混叠

针对两头同龄雄性幼鲸近距离身体接触时连续重叠喀哒声串难以归属的问题,论文用单通道恒 Q 变换谱加步间间隔节律做声学解交织,再用三元紧凑阵列到达时差定位投影到视频验证,在简单场景聚类误差为 0.0%、最难场景达 25.79%,并以 10 度容限实现主要发射者最高 100% 水平视觉一致,代价是垂直方向系统性偏差与近平面阵列几何盲区导致两个场景无法最终归属。

 · 更新于 2026-09-25 · 约 20 分钟 · 9640 字 阅读 →
论文解读

把自行车变成可移动合奏:BIKES 如何用联网与制作串起教学

BIKES 把电动货运自行车做成可移动联网乐器,用集中式到网状网络、分布式音频与工业设计迭代解决户外移动演奏与教学问题,最强证据是四车系统的公共骑行与装置验证,代价是第二阶段外观模型尚无发声功能且系统依赖现场网络与人工运维。

 · 更新于 2026-09-25 · 约 20 分钟 · 9986 字 阅读 →
论文解读

自带弓直接拉:离弓传感实时反推弓压与弓速去驱动摩擦模型

该文用弦两端载荷单元反推弓弦压力、用固定磁场感生弦速直方图分离粘弦速度来实时估计弓速,并把两路参数接到弓—质量摩擦模型验证可演奏性,代价是必须贴近支点与磁体运弓且力估计存在位置相关偏差。

 · 更新于 2026-09-25 · 约 21 分钟 · 10116 字 阅读 →
论文解读

静止并不平静:CALM 把身体不稳定翻译成作曲结构

CALM 研究如何把双侧身体运动、费力和协调直接转成声音密度与空间行为,证据是手套速率与双侧阈值控制的 abrasive 静止层与和声运动层的对抗结构,代价是放弃快速即兴与精确可移植性。

 · 更新于 2026-09-25 · 约 20 分钟 · 9645 字 阅读 →
论文解读

植物不发声却写谱:生物电与环境数据如何变成可演奏的总谱

该研究把植物生物电与光照湿度数据经物联网送入作曲环境来实时生成六声部乐谱,早期排练与观测显示声音与光照变化伴随信号波动,但完整演奏者与植物反馈闭环与互惠机制仍待验证。

 · 更新于 2026-09-25 · 约 23 分钟 · 11324 字 阅读 →
论文解读

法语嘎裂嗓能量化吗:H1-H2 与 H1\*-H2\* 在法英复述任务中的对照检验

论文以法语为实验组、英语为对照组,用复述童话反派台词诱发嘎裂嗓,对比 H1-H2 与 H1*-H2* 与视听定性判断的一致性,报告校正量 H1*-H2* 在英语对照中达 89% 而在法语中仅 72% 且出现双向误判,因此不建议直接移植英语阈值。

 · 更新于 2026-09-25 · 约 17 分钟 · 8499 字 阅读 →
论文解读

把精神科听诊变成可量化的韵律测量:一个嵌入问诊的说话人-轮次-韵律工具

该研究不做端到端疾病分类,而是构建覆盖说话人日志、轮次结构、识别对齐与韵律计量的临床增强工具,并在 18 例躁狂住院患者的 5.6 小时纵向访谈中报告发音速率等四项时序指标与症状显著相关,代价是仍需人工校对且多语言与角色泛化待验证。

 · 更新于 2026-09-25 · 约 19 分钟 · 9117 字 阅读 →
论文解读

把声音铺在身体周围:以可导航的语料库建造超环境

该文以四个舞蹈配置研究如何把预分析音频语料分布到舞者周围的虚拟体中并用动作做最近邻提取,最具体的证据是共享大体量与手部小体量在单元数与速度上的对照,代价是正式成片采用离线合成因而缺少实时演奏反馈。

 · 更新于 2026-09-25 · 约 20 分钟 · 9761 字 阅读 →
论文解读

不做成像也能摸:木薯生物塑料薄壳如何变成可分类的触摸声场

该研究把木薯淀粉生物塑料做成不规则触摸面,用 8 电极电场层析扰动加支持向量机分类代替图像重建,在圆形样品与 55 厘米半球壳上验证了中等分辨率触摸词表的一小时稳定与 48 小时漂移代价,最终为一个月展期的低分辨率声音装置选择了保守映射。

 · 更新于 2026-09-25 · 约 22 分钟 · 10691 字 阅读 →
论文解读

把临床对话变成可复核的时间线:自动语音分析如何从噪声中算出韵律

该演示针对精神科访谈中非正式韵律观察不可复现的问题,给出从录音到说话人分段、转写、音节定位再到时间韵律指标与人工核对的端到端流程,并以一段含 2 人 3 轮的示例说明可视化核对方法,代价是仍需人工复核且未报告定量精度与临床阈值。

 · 更新于 2026-09-25 · 约 18 分钟 · 8940 字 阅读 →
论文解读

用一个非线性迭代跟住人:IPF 如何把节奏同步做成可复现的响应过程

该文把节奏同步建模为单反射点 IPF 对外部点击轨的逐拍跟随问题,用人工阶跃、线性、正弦与噪声点击轨检验同步、过冲与多节奏锁定范围,代价是存在明显相位差和过渡振荡且只用受控仿真而非真人合奏验证。

 · 更新于 2026-09-25 · 约 20 分钟 · 9721 字 阅读 →
论文解读

同一内存里的作曲与发声:Clamps 如何把 DSP 与元层缝在一起

论文要解决高层作曲组织与底层实时 DSP 长期分离的问题,选择全部用 Common Lisp 重建调度、合成、记谱与界面,最强证据是同一 Lisp 映像内改 UGen 与预设并即时发声,代价是依赖 Incudine 与 CLOG 等外部生态且无受控定量评测。

 · 更新于 2026-09-25 · 约 23 分钟 · 11030 字 阅读 →