椰壳共鸣的两根丝弦如何被算出声音:耶胡的刚性弦、弹塑性弓毛与模态琴桥
该文把耶胡拆成两根刚性弦、按压手指、弹性弓毛与模态琴桥来做有限差分声音合成,用锤击与激光测振标定弦与琴桥参数,在弓弦稳态速度拟合与 10 秒音频约 1.49 秒算完的实时性上给出证据,代价是手指参数靠经验选取且弓力弓速在演奏验证中未知。
该文把耶胡拆成两根刚性弦、按压手指、弹性弓毛与模态琴桥来做有限差分声音合成,用锤击与激光测振标定弦与琴桥参数,在弓弦稳态速度拟合与 10 秒音频约 1.49 秒算完的实时性上给出证据,代价是手指参数靠经验选取且弓力弓速在演奏验证中未知。
针对直线步进音序器割裂塔拉循环连续性的问题,RhythmTable 用 86 cm 圆形桌面加角度触发与视觉跟踪实现多人共置演奏,形成性观察显示陌生人可在数分钟内拼出对称多边形与复节奏,但遮挡与非结构化评估仍是主要代价。
该研究用市售游戏手柄加本地 3D 打印辅助件加安卓开源应用解决无障碍乐器难以持续复制的问题,在印度北部非营利组织的 7 人部署中验证了可本地采购组装和约 15 分钟上手,但未做正式效果评估且存在音频格式与配件适配代价。
针对手势完成后才识别再生成导致 213 ms 级感知延迟的问题,论文用提前预测手部落点并预生成音频加猜错回滚的方法,在 16 选 1 受限实验中把 Top-15 预测做到手势完成前发声、Top-16 做到 77 ms 微观尺度,代价是 Top-1 单猜错误率高达 66 %。
该研究用可微扩展 Karplus-Strong 做事件级声音匹配,证明时域拉格朗日插值梯度可用且无时间混叠,揭示频谱损失无法给出多事件起音方向梯度,仅用合成参数损失能学到音高音色与起音但难泛化,真机上外部检测器加音频损失最稳,而谐波加噪声基线多数重建指标更高。
论文把作曲从指定事件改为设定条件,用三层架构与成对射频加声学校准推断相对拓扑来参数化局部耦合,合成验证显示双模态距离误差降到 10.03 cm 左右而位置误差方差仍大,代价是真实房间性能尚未验证。
论文研究截止与共振随时调制的梯形离散虚拟模拟滤波器如何证明有界输入有界输出稳定,方法是把连续域公共二次李雅普诺夫函数保留到离散域,最强证据是状态变量与 Sallen-Key 全范围稳定而 Moog 梯在 2.88 与 2.89 之间出现稳定与发散分界,代价是 Moog 与二极管梯在全共振范围不能保证时变稳定。
论文用导电琴弦加永磁体实现传感与驱动同位,用 20 kHz 时分复用交替完成感应电动势采样与脉宽调制洛伦兹力驱动,在单弦琴与改装自动竖琴和天气竖琴上验证了免校准自持,其代价是只能控制单轴、受热漂移与材料限制且伴随代码链接当前不可用。
该研究以约 35 分钟协奏曲为载体,用 BBC 爱乐广播档案训练 RAVE 与拼接合成乐器来驱动作曲与现场演奏,报告显示嵌入式 AI 塑造了全曲结构而非仅 moment 声音,代价是记谱、延迟与排练可信度需专门设计。
论文用轮廓复信号傅里叶分解做形状到音色映射,用面积做包络、用极坐标位置做混音,在键盘保音高时序下实现可重复的物件预置,代价是仅用二维剪影且边缘畸变与电平部分耦合。
针对乐器起振与调制在分析帧内非平稳的问题,该工作用分布导数法估计三阶多项式调幅调频正弦,在 39 个乐器声音上获得更高的信号残差比并在听感上接近原声,代价是峰选择不当仍是主要误差来源且频谱距离指标并不总是最优。
共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读
共收录 199 篇 acl-2026 会议论文的 Reader 深度解读
针对文本到音乐模型的黑盒提示词窃取问题,AudioStealer 用相似度引导的启发式搜索定方向、再用沙普利值量化各语义单元贡献做精修,在 InspireMusic 上以语义 59.4%、音乐 70.1% 的可复现流程实现最强证据,代价是依赖本地影子模型的多次查询与精修计算。
论文把问题定为给定干声吉他与目标效果标签、合成对应效果声并保留音乐内容,用同一事件序列配对的 EGFxSet 衍生数据比较四种谱变换模型,最强证据是 log 幅度 U-Net 相对复制输入基线平均改善 MSE 约 70.6% 与 FAD 约 31.8%,代价是延迟混响类 FAD 增益弱且域外真实演奏变换减弱。
针对电子鼓多轨采样与录音的算力与成本问题,该工作用单块 Artix-7 实现 10 路鼓采样加 4 路外部输入、可变速率重采样、五种效果与以太网 16 轨录音,报告采样处理链约 1.33 ms 与 512 采样环形缓冲下无欠载过载,同时占用约一半逻辑资源并控制整机成本在 500 美元以下。
该文把求载波复音以产生目标二次差频谱的问题转成学习失真函数连续近似逆,用齐次结构加课程式训练换来可实时插值的合成器,代价是重建误差略高于随机牛顿迭代。
Muse 针对长歌曲不可复现问题,用 116489 首授权合成歌曲与全局加分段风格标注训练单阶段自回归模型,在小参数下取得可比的歌词对齐与风格相似度,并以多轮分段生成实现细粒度风格控制。
该演示用同一录音走完七条离线分析—表示—渲染链,把音高轮廓、切分表与轨迹等中间物变成可检查的作曲控制器,代价是放弃实时并依赖预渲染与人工核对。
该文以脉冲成形原理重访脉冲表合成,用按基频索引的单周期脉冲加时变低通、成形噪声与混响生成铜管音色,并以小号三八度与起振微调制案例说明表情来自三条控制曲线的联动,代价是脉冲与轮廓仍难从混响录音中稳健自动提取。