缺哪条补哪条:用验证器把乐谱约束变成可分级的训练信号
针对多约束联合满足急剧下降的问题,论文用八族程序化验证器构造基准并以硬门加分级奖励做 GRPO,把 Qwen3-4B 在 Mixed 上的全满足率从 0.160 提升到 0.807,代价是奖励与评测共用同一套验证器且只度量合规不度量听感。
针对多约束联合满足急剧下降的问题,论文用八族程序化验证器构造基准并以硬门加分级奖励做 GRPO,把 Qwen3-4B 在 Mixed 上的全满足率从 0.160 提升到 0.807,代价是奖励与评测共用同一套验证器且只度量合规不度量听感。
论文用 124 位作曲家的旋律续写任务训练条件 Transformer,只以作曲家身份为监督,学到的 124×128 嵌入的第一主成分与出生年强相关并通过打乱检验,最强的向量算术例子同时暴露了旋律表征覆盖不了配器音色的代价。
论文把考试式四部数字低音配写形式化为相邻事件上的硬约束与局部代价问题,用完整和声状态的分层图与动态规划证明固定声部数下可行性与最小代价可多项式求解,并以二拍、四拍、八拍实例展示合法性、贪心失效与复现步骤。
共收录 60 篇 icmc-2026 会议论文的 Reader 深度解读
该研究以检索加规则检验做古典钢琴符号混搭,用 8 小节可控听辨分离和声、终止逻辑、动机可辨识度和织体四个因素,发现终止逻辑与可辨识度及复调并置更关键,代价是仅在短片段、均匀钢琴音色和小样本条件下成立。
该文把钢琴指法当作带生物力学约束的序列标注问题,用卷积网络提局部键盘模式、双向长短期记忆网络建前后依赖并加注意力与前向规划,在钢琴指法数据集上报告通用匹配率约 82.6%、最高匹配率约 92.1%,代价是去掉物理约束后通用匹配率掉 11.4 个点且复调大跨度仍需人工把关。
该研究把植物生物电与光照湿度数据经物联网送入作曲环境来实时生成六声部乐谱,早期排练与观测显示声音与光照变化伴随信号波动,但完整演奏者与植物反馈闭环与互惠机制仍待验证。
针对大语料深度模型不适用个人作曲且只处理音高时值的问题,该文把带表情的动机表示为音程状态轨迹并以卡尔曼式随机偏离生成变体,用作曲家自己的选择在线调节方差与结构编辑概率,代价是只做单声部且无定量评测与用户研究。
本文回溯 1980 年代中期以来以西方记谱与音高节奏形式化为核心的计算机辅助作曲,指出其在音色连续性、实时性与多模态输出上的局限,并提出以多模态输入输出与人机协作为方向的扩展愿望,但未提供定量实验验证。
针对现场钢琴对话中缺力度、无明确轮次和输出延迟破坏节奏的问题,论文用四元组力度建模加 ggml 加速、脚踏开关标注的呼应微调与逐音符延迟补偿来回应,最强证据是逐音符补偿把节拍对齐中值提高到 0.7834 而无补偿仅 0.0678,代价是上下文能装的音符数从 341 降到 256 且风格仍局限于单人专家数据。
该研究把飞利浦馆重建为九片直纹面并提取线与点来驱动弦乐滑音、五个能量块与稀疏铜管木管事件,最强的可核对证据是 36 条弦乐线与 3357 个采样点的确定性构造,代价是均匀插值难以保留局部曲率与统一配器难以推广到其他风格。
该文把作曲家定义的文本语料经语义嵌入、降维与量化压缩为可枚举的卦象状态,用以配置数字乐谱的结构条件而非生成声音,并以五句雨诗得到离散对偶输出的艺术实例展示其可解释与可重复的即兴逻辑,其代价是降维随机性带来的状态不稳定性。
针对铃球接住才发声带来的延迟与换球规划难题,论文用音乐 Siteswap 记谱加三维动画组件把整场演出算成可排练的事件序列,已能复现协奏曲等复杂曲目,但仍需补创作与训练环节的可用性验证。
论文以 2021 年为波伦-皮尔斯单簧管与电子音乐而作的 Linear A 为对象,用 bach 可视化与约束微分音高、用标记驱动卡农与量化、用 MuBu 分段与 SuperVP 重排加 Antescofo 跟谱串起构思到演出,最强证据是同一套标记同时生成乐谱与实时指令,代价是全流程依赖特定 Max 生态与手工校准且无定量对照。
共收录 160 篇 nime-2026 会议论文的 Reader 深度解读
RenCon 2025 用线上预选加 48 小时 unseen 现场渲染考查乐谱到钢琴演奏的转换,9 套系统中规则系统与层次循环网络居前而人类基线 4.40 分仍明显领先,代价是力度校准与主观评价仍未标准化。
论文以智利混合音乐计算机 COMDASUAR 为对象,逆向还原其 Intel 8080 硬件与汇编软件协同,最强证据是逐字节原地逆行并修正滑音与终止符的子程序,代价是通用框图与音频路径尚未完全验证且无定量性能比较。
论文把以 TidalCycles 为源头的现场编程家族改称为 Uzulangs,方法是用时间的纯函数加查询窗口表示模式,最强证据是查询、连接与可视化在多个语言中可复述,代价是放弃状态导致马尔可夫链等有状态写法很少被使用。
该文把基于模式的现场编码做成二维解谜游戏的核心操作,用代码、声音与角色移动三种同步表征支架化时机、重复与分层,5 人单次 45-60 分钟试玩显示组织更 deliberate,但无对照与可推广性声明。
该文把毛笔旋转速度作为外部控制层,用距离积分触发主旋律、用阈值开关控制和声层,调用公开 Notochord 模型生成多轨 MIDI 并经 Ableton Live 发声,以一次约五分钟的水写布现场演示验证可演性,代价是只用陀螺仪而缺压力与长结构建模。