论文解读

不追紧同步的混音台:Mezcal 用浏览器 MCU 把远距离合奏做成电台

Mezcal 要解决多人随时随地用浏览器做协作电台的问题,选择 Janus 网关的 MCU 集中混音加 N-1 返送与档案代理,最强的实践证据是持续 6 年的 Conduction Series 等跨国直播,代价是放弃紧同步演奏并承担集中带宽与代理成本。

 · 更新于 2026-09-24 · 约 21 分钟 · 10469 字 阅读 →
论文解读

边界决定音高:从矩形板到克莱因瓶的模态推导与混响合成

论文以二维波方程与商空间拼贴推导矩形、环面、莫比乌斯带、克莱因瓶与实射影平面的闭式模态,并用有限差分时域仿真验证频率误差约 0.02% 量级、模态置信接近 1,代价是不可嵌入三维的非定向拓扑只能在平面基本域加边界规则中间接实现。

 · 更新于 2026-09-24 · 约 18 分钟 · 9006 字 阅读 →
论文解读

不训练新模型:在编解码器令牌上借音色、保节奏

问题是用现成神经音频编解码器做可演奏的音色迁移,方法是不训练新生成器而检索调色板令牌颗粒并做连续性约束的序列选择与分组替换,最强证据是调色板扩展下中位实时系数仍低于实时,而代价是分块渲染与完整上下文不等价且缺乏听感验证。

 · 更新于 2026-09-24 · 约 21 分钟 · 10168 字 阅读 →
论文解读

去掉运行时抽象的波数字电路仿真:用静态代码生成逼近理论下界

针对波数字滤波器实时仿真中面向对象抽象与冗余状态带来的开销,论文用描述语言加静态编译生成最小状态代码,在四类电路上以每样本周期数与指令数为证据逼近理论性能界,代价是拓扑必须在编译时固定并依赖热重载维持可修改性。

 · 更新于 2026-09-24 · 约 20 分钟 · 9917 字 阅读 →
论文解读

把步进音序器当乐器演奏:低维规则如何保住手势与作者权

该文把欧几里得节奏与方向性旋律遍历做成可在 Pure Data 中多实例叠层的 MIDI 音序器,用两次第一人称即兴回答可演奏性问题,最强证据是双实例下手势与结果的即时可读性与四实例下受约束调制对复杂度的缓解,主要代价是复调层数增加带来的感知负荷与旋律多样性受限。

 · 更新于 2026-09-24 · 约 25 分钟 · 12035 字 阅读 →
论文解读

检索与合成分开做会断流:QuAP 把找声音和造声音放进同一个插件

针对影视非语音非音乐音效在检索与程序化生成之间频繁切换的问题,QuAP 用混合检索加六个程序化模型加规则助手统一工作流,主证据是 16 人用户评估与 MUSHRA 在六类中五类显著改善和 FSD50K 上 MobileNetV3 检索占优,代价是 Rocket 与 Jet 等类别仍不够逼真且仅支持六类。

 · 更新于 2026-09-24 · 约 20 分钟 · 9636 字 阅读 →
论文解读

演出中途改映射:当跳舞的人不管声音、调声音的人不跳舞

该文研究演出中实时重配动作到声音映射时的分工问题,用十天工作坊加两场约八分钟公演的单案例表明耦合环境把控制权在舞者与操作员之间重新分配,代价是基线可预测性必须保留且结论不可统计推广。

 · 更新于 2026-09-24 · 约 20 分钟 · 9853 字 阅读 →
论文解读

不用对钟也能合奏:用空间排布与关系感知组织声音群体

论文把作曲从指定事件改为设定条件,用三层架构与成对射频加声学校准推断相对拓扑来参数化局部耦合,合成验证显示双模态距离误差降到 10.03 cm 左右而位置误差方差仍大,代价是真实房间性能尚未验证。

 · 更新于 2026-09-24 · 约 23 分钟 · 11460 字 阅读 →
论文解读

把错音弹对:用不看键盘的敲击把大模型当成伴奏

论文把与大模型对话的键盘重读为乐器,提出不看键盘屏幕的 vyping 技法并用 ll00mtube、clix-vibe、KeyMeter 三个软件探针呈现时间与声音维度,其代价是标准聊天接口目前丢弃击键时序且全篇无受控用户实验支持泛化判断。

 · 更新于 2026-09-24 · 约 20 分钟 · 9532 字 阅读 →
论文解读

把拼接输出写进卷积核:单引擎如何在连续换混响时保住能量

针对卷积混响只能静态切换脉冲响应的限制,该文把语料拼接合成的输出直接作为时变卷积核,并用单引擎频域核插值保留卷积状态,在持续插值下报告更低的每块耗时与更平稳的响度,代价是近反相频点仍存在线性混合固有的相位抵消且缺乏感知听音验证。

 · 更新于 2026-09-24 · 约 21 分钟 · 10326 字 阅读 →
论文解读

三点脉冲响应如何撑起一条隧道的可走动混响:Bunkervik 共极点模态引擎

针对长条形隧道内接收位置连续变化时混响特征平滑过渡的问题,该演示用三位置实测脉冲响应构造 6300 个共享极点的模态合成引擎并做残差插值,时域归一化误差低于 3.5%,代价是仅覆盖纵轴一维移动且高频需外推补偿。

 · 更新于 2026-09-24 · 约 22 分钟 · 10990 字 阅读 →
论文解读

在二维平面上连续试听脉冲响应集合:IRIS 用高斯加权与有界卷积做轻量导航

IRIS 把已测或自定义脉冲响应集合排成二维可导航平面,用高斯距离加权与最多 8 路有界卷积做实时试听,在 Apple M4 Pro 上 512 采样缓冲下 16 路 1 秒 IR 平均 2.87 毫秒等三组条件保持在 10.67 毫秒预算内,代价是只做简化时域混合而不保证物理最优与感知透明。

 · 更新于 2026-09-24 · 约 15 分钟 · 7356 字 阅读 →
论文解读

手腕不动琴:把传感、映射与效果链收进同一个 Csound 文件的 L-Bow

针对现场演出中传感器链路易失灵的问题,L-Bow 用腕戴六轴惯性单元加 Csound 原生 arduinoRead 直读串口,把采集、六种演奏模式与共享效果链收进单个.csd 文件,报告显示 20 次触发测试零误触发且平均延迟比 Python-OSC 桥低 22.5 ms,代价是 10 位量化和 9600 波特率下的分辨率与帧时间限制。

 · 更新于 2026-09-24 · 约 20 分钟 · 9981 字 阅读 →