把同步后的波形算成频谱搬移:加法合成做无混叠振荡器同步
针对硬同步直接重置相位会产生不连续和高频混叠的问题,论文用有限傅里叶系数经线性频谱重采样再做加法合成实现带限同步,并以 96 kHz 单音色 ASIC 在约 5 个音频采样内完成变换为代价换取实时性。
针对硬同步直接重置相位会产生不连续和高频混叠的问题,论文用有限傅里叶系数经线性频谱重采样再做加法合成实现带限同步,并以 96 kHz 单音色 ASIC 在约 5 个音频采样内完成变换为代价换取实时性。
针对小频移下谱平均被抹糊的问题,该文把熵正则 Wasserstein 重心约束为给定阶数全极点谱,用 Sinkhorn 加反射系数参数化梯度下降求解,在 TIMIT 五音素上以平衡准确率与 F1 略优于非参数重心,但优化非凸只能得到次优平稳点。
针对听音房间混响破坏高阶 Ambisonics 解码方向感的问题,作者把常规解码级联一个由闭合球面控制点房间脉冲响应求逆得到的串扰矩阵,在 26 扬声器仿真房间中使同通道能量在 500 Hz 到 4 kHz 高出约 10 dB,代价是依赖已知房间脉冲响应与高频预处理且频带外仍有串扰。
该文用转角域重采样加阶次跟踪从实录提取随转速和扭矩变化的谐波指纹,再驱动谐波加噪声合成器生成带四通道嵌入标注的音频,证据是 8 个子集上阶次结构随工况对应且基线网络可收敛,代价是高阶细节为参数化改动而非逐频复刻。
该文把多边形合成改写为等弧长遍历外部顶点缓冲的二维振荡器,用混合插值实现不等顶点数形变、用旋转多面体水平截面扩展到三维,并以四点 polyBLAMP 加自适应过采样压制混叠,最强证据是 M=5 四形状共享谐波格而格外成分低于分析底噪,代价是几何缓存、成对齐与交叉淡化的额外管理。
针对目标与干扰在单个阵列看来同方向而波束形成失效的问题,该研究用几何约束线性解混做空间滤波、再用跨阵列非目标估计构建多通道维纳后置滤波,在三阵列混响实验中多数指标超过 NMF 与 NTF 基线,但稀疏先验强度与混响条件会带来失真与抑制的权衡。
针对板混响脉冲响应中弱模态与重叠模态难以直接检出的问题,该研究先用回归器预测四个频带的模态数量以确定稠密网格基数,再固定频率对衰减与增益做有界可微校准,在两个仿真验证集上把本地挑战式误差相对官方默认峰值拾取降低约 66%,主要收益来自计数误差下降而衰减与增益仍是最大残差。
该研究以骨传导耳机私密层加穹顶扬声器共享层加现场声源的三层现场为问题,用四部新作与作曲家自述对照出频带分工与层间关系策略,最强证据是录音仓储已公开可核对,代价是电平与注意力极易饱和且结论仍是作曲家报告而非大样本验证。
针对身体打击乐需要压电传感器稳定安装又需要服装柔软贴身的矛盾,该研究用消费级三维打印柔性聚氨酯基板加背部嵌入式处理的方法制作马甲与手套,并在 2025 年两场公开演出中验证了可穿戴演奏的稳定性,其代价是以定性使用验证代替受控定量评估且声学映射完全开放给艺术家二次完成。
论文追问电子萨克布特到底是什么,用档案与实物逆向复原其阻塞振荡器、分频器、鉴频器与压控放大的信号与控制链,显示它由计算、收音机与电子风琴三条技术血统拼合,并由国家研究委员会技工、绘图、秘书与通信网络共同制成,但代价是缺乏完整图纸使第一台合成器之说难以确证。
针对高阶全通变换 DCT 分析合成滤波器组相位与混叠失真难以同时补偿的问题,论文用凸最小二乘直接求解 FIR 合成子滤波器系数,以完全重建设计实现全局最优,并以混叠受限的近完全重建设计换取更好的合成滤波器频率选择性。
论文把 Pharo 集成开发环境变成不停机的现场作曲工作站,用 Coypu 做节奏旋律型调度与事件分发、用 Phausto 内嵌 Faust 编译器做本地合成,并报告了固定十六分音符网格、五类演奏器与 70% 库覆盖等条件与代价。
该系统用 Muse S Athena 头环采集脑电频段经 Mind Monitor 以 OSC 送入 Csound,以采样保持加 SATB 查表把生理抖动驯成稳定和声并用 MIDI 键盘做移调与乐句控制,在双人互换脑电的现场二重奏中验证了可演奏性,代价是放弃连续调制精度且未做定量听感与延迟测量。
共收录 103 篇 cvpr-2026 会议论文的 Reader 深度解读
共收录 91 篇 dafx-2026 会议论文的 Reader 深度解读
针对弓弦乐器源-滤波器分离含混问题,DDSP-Violin 用亮度、弓位与残差约束谐波源,在合成数据上把体共振重建误差做小,而多尺度频谱重建质量基本不下降,代价是仍有局部共振细节误差与相位不定问题。
针对分布式子阵列间通信贵、难同步的问题,论文提出只在子阵列间共享非负矩阵分解变量的三种去中心化独立低秩矩阵分析,并报告基共享变体在混响与采样时间偏移下保持稳定分离的主要证据与建模代价。
论文把 sygyt 双声复制写成从录音反推声道形状的可微优化问题,用带舌下第二声源和 B 样条声道的 Kelly-Lochbaum 波导在 20 段录音上把对数谱距离相对基线降低 30-38%,代价是每段仍需约 30 分钟离线优化且绝对误差仍在 9 分贝量级。
针对和声乐器混合难以分声部精确编辑的问题,该演示系统用乐谱对齐加可微混合合成器做分析合成,再用合成参数域扩散模型约束参数轨迹,在双长笛混合上展示单声部乐器转换与乐句改写的定性例子,但未报告定量指标与可运行代码。
针对模数转换器动态范围不足导致的削波与绕回溢出,该文在模拟前端引入模折叠并用分帧离散余弦变换加矩阵铅笔法恢复丢失的高位,硬件实验报告在严重削波下提升超过 25 dB,但依赖过采样与带限平滑先验且对硬件非理想折叠需鲁棒处理。