把轮廓变成频谱:预置合成如何让日常物件决定音色
论文用轮廓复信号傅里叶分解做形状到音色映射,用面积做包络、用极坐标位置做混音,在键盘保音高时序下实现可重复的物件预置,代价是仅用二维剪影且边缘畸变与电平部分耦合。
论文用轮廓复信号傅里叶分解做形状到音色映射,用面积做包络、用极坐标位置做混音,在键盘保音高时序下实现可重复的物件预置,代价是仅用二维剪影且边缘畸变与电平部分耦合。
论文用 1948 年调音叉笔记的 8 个实测频率驱动 Pure Data 与 Vital 合成,以 8 块废滑板加压电传感与 Bela Mini 实现 10 毫秒以下击打响应并在驻地验证合奏可行,但未测量声学相似度与延迟分布。
论文要解决如何用带状控制器表现中国弦乐的滑音与微分音,方法是把田进勤 XK 系列形式化为左手连续音高加右手连续包络的交互模式并用碳膜与开源硬件重建 XK-S,最强证据是 3 毫米宽碳条在 223±21 千欧下获得可用线性与可演奏性,代价是每条传感器都需逐条校准且 MIDI 难以表达连奏手势。
论文把自我归因的操作化为演奏时对响度的感觉减弱,用压力线性和时间记忆两种映射扰动检验它,结果显示只有大音量下出现预期的减弱方向,而映射主效应不显著且样本小、学习效应未分离。
作者为摆脱 Traktor 专用软件依赖,在 Mixxx 中逆向 S4 Mk3 力反馈转盘,通过 USB 抓包与试凑滤波加 PID 复刻出可演出的转盘仿真,但触摸量化、点推校准与 cue 停盘等处仍需妥协且手感与原厂有可感差异。
论文研究如何在低功耗乐器内嵌入可调映射学习,让演奏者在演奏中用奖惩塑造神经网络映射,报告显示可高速探索大参数空间但精调困难且依赖预设偏置。
针对传统黑胶台难容纳现场采样与定序且不愿依赖屏幕的问题,论文用可复用的颜色令牌 Tamples 加 Bela 中央主机与 ESP 外设的模块扩展套件来保持搓盘手势,并在音乐节与酒吧演出中报告了无线与颜色识别稳定可用,但代价是令牌本身不显示内容且序列器暂只发音符开事件。
该研究把便携超声探头扫查手工食物明胶幻影得到的深度密度图像,经取样线重采样后送入逆傅里叶变换合成声音,探头推滑按压与材料雕刻共同作曲,代价是频率分辨率粗糙、低频表现弱且模具精度不可控。
针对通用 MIDI 控制器丢失跳线等小手势的问题,Umbilical 用数字共生体加物理镜像实现一对一映射,最强证据是 1024 点跳线矩阵以约 60 赫兹扫描实现约 4.6 毫秒最坏延迟,代价是串口带宽限制扫描频率且源码目前处于禁运不可用。
针对噪声加混响同时存在的语音与音乐恢复问题,论文把多麦克风观测的最小二乘数据保真项与正则项组成反问题并用前向后向算法展开为 10 层网络,在已知或估计房间冲激响应与噪声标准差的条件下,LibriSpeech 上多麦克风展开结构取得最好客观与主观指标,代价是依赖房间与噪声先验且去混响层数与去噪器规模不可过小。
该文把预训练瓶颈定位为监督源弱而散,用高保真描述器加统一标签系重建强监督,并在同量音频上比较多种目标,显示数据质量与覆盖决定泛化而目标决定任务分化,但域内事件任务仍需更大规模验证。
针对乐器起振与调制在分析帧内非平稳的问题,该工作用分布导数法估计三阶多项式调幅调频正弦,在 39 个乐器声音上获得更高的信号残差比并在听感上接近原声,代价是峰选择不当仍是主要误差来源且频谱距离指标并不总是最优。
针对吉他缺乏力度标注的问题,该工作用虚拟乐器渲染带力度标签的合成数据先学力度曲线,再把冻结的力度子模块拼到在真实录音上训练的音高转录模型中,合成集上平均绝对误差从约 32 降到约 7 但跨音色误差增大,而在 GuitarSet 与 EGDB 上的音符转录 F 值只提升约 0.1 个百分点。
论文以制作中的触觉声音界面 Kirma 为线索,提出先经盘卷编织、手感聆听与在地拾取形成手势拓扑,再让电容传感与合成去转译编织已组织起来的连续声音,当前证据停在材料样机与方法阐述,电子与声音映射尚未实测验证。
论文以 M2D 自监督 ViT 为对象,用音频激活概率熵找出类特异神经元,报告其在未见任务上接近全类别覆盖与跨任务共享,并以不足 1% 神经元的失活验证其对分类的功能影响与局限。
该研究以语义取向的反思性主题分析追踪 NIME 2001-2025 年文献中 touch 一词的显性用法,用 158 篇初检经两轮过滤到 119 篇与 526 条编码的完整链条显示 453 条编码归于应用技术与设计的操作话语,代价是历史与扩展讨论长期稀缺且缺乏概念化。
WildFX 针对 DAW 托管插件链缺乏成对音频与图标签的问题,用 REAPER 加容器化批量渲染生成带路由和参数标注的多轨数据,盲图估计实验显示浅层图比深层图更易估计但节点识别仍是主要失败模式,且受限于小规模插件库和短训练预算。
论文把增强边界从外部参数映射搬到电路内部的电压电流关系,用低延迟数字阻抗替换哇音谐振网络中的无源元件,在保留脚踏交互的同时展示了从近似仿真到失稳自激的可复现探索空间,但代价是高频不稳定与对延迟和拓扑的高度敏感。
针对无损完美循环压抑偶然与主动性的问题,Zen-PCB 用裸露印制电路板做皮肤与 5 行 3 列导电短接矩阵做输入,配合 16 颗粒 WSOLA 与处理后写回同一环形缓冲的破坏链路实现持续音蚀,最强证据是 15 人评价中享乐刺激达 0.98 而实用质量仅 0.55,代价是 22.05 千赫低保真与直觉优先于效率。
该文把声学放到一边,从任意个全音阶音出发构造半音与等价类,并以反射性和最大偶性解释为何标准十二音系统在纯句法意义下仍是可用选择,但非标准十九音等系统也能被同一语言描述。