电子萨克布特不是一个人发明的:从脉冲、分频到众人手的电路史
论文追问电子萨克布特到底是什么,用档案与实物逆向复原其阻塞振荡器、分频器、鉴频器与压控放大的信号与控制链,显示它由计算、收音机与电子风琴三条技术血统拼合,并由国家研究委员会技工、绘图、秘书与通信网络共同制成,但代价是缺乏完整图纸使第一台合成器之说难以确证。
论文追问电子萨克布特到底是什么,用档案与实物逆向复原其阻塞振荡器、分频器、鉴频器与压控放大的信号与控制链,显示它由计算、收音机与电子风琴三条技术血统拼合,并由国家研究委员会技工、绘图、秘书与通信网络共同制成,但代价是缺乏完整图纸使第一台合成器之说难以确证。
该研究让 61 名 11 至 13 岁中学生在约 1 小时内用纯乐高做可演奏声学打击乐器,用三档说明书做支架对照,以 51 件留存乐器和 30 件细审样本显示摇奏类占 72.73% 而中观与微观层大量偏离图纸,代价是结构与声学权衡只能靠现场试错解决且无正式创造力量表评分。
共收录 91 篇 dafx-2026 会议论文的 Reader 深度解读
该文要解决现场表演中表达意图与听众感受难以对齐记录的问题,选择设计一套从练习曲到即兴的可重复多模态采集协议,用 16 场录音的阶段与表达性对照趋势验证流程可行,代价是商用低通道传感器保真度有限且样本存在西方与人口偏斜。
共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读
该研究把管弦乐引子与静息任务态脑电都转成时间序列做复发分析,用层流性、确定性、复发率和缺隙度刻画动力学组织,并提出局部密度相似性做音乐与脑电复发图的跨比较,最强证据是贝多芬引子与健康脑电的平均局部密度相似性下降最大而柴可夫斯基最小,代价是仅两例被试与首 60 秒音乐的探索性小样本。
以同一 SPICE 梯子电路为基准,用谐波、自振荡与大信号截止点偏移三类可复述测量,比较五种数字实现并在公共核心上做饱和器与位置消融,最强证据是分布式 1+4 级实现聚在频谱误差 0.04% 至 0.10% 而边界饱和的 JUCE 达 0.65%,代价是只覆盖静态与准静态条件且未做听感与硬件验证。
该研究用 152 人三组标签对照检验镇静与振奋两类情绪音乐,显示人作音乐被评更有效而偏好更偏向 AI,且误标驱动偏好,振奋高唤醒场景下人作优势更明显,代价是刺激仅 4 首且质性编码为单人。
该研究以语义取向的反思性主题分析追踪 NIME 2001-2025 年文献中 touch 一词的显性用法,用 158 篇初检经两轮过滤到 119 篇与 526 条编码的完整链条显示 453 条编码归于应用技术与设计的操作话语,代价是历史与扩展讨论长期稀缺且缺乏概念化。
该文把声学放到一边,从任意个全音阶音出发构造半音与等价类,并以反射性和最大偶性解释为何标准十二音系统在纯句法意义下仍是可用选择,但非标准十九音等系统也能被同一语言描述。
共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读
共收录 199 篇 acl-2026 会议论文的 Reader 深度解读
BoYaEval 用 3175 张原貌古谱图像把考题分成认符号、译指法、推旋律三层,报告显示 21 个主流多模态大模型在基础识别尚可但在旋律推理仅约 27% 到 30%,而把示例从零增至多示例也不能打通跨谱式推理瓶颈。
针对 MIDIBERT 做符号音乐情绪识别时调式-情感关联缺失的问题,用 Krumhansl-Kessler 提取大/小调并以 FiLM 注入第一层,在 EMOPIA 达 75.2% 准确率、VGMIDI 达 59.1% 准确率,代价是只用二分类调式并依赖自动调式估计的正确性。
该研究针对完整乐谱的多级理解问题,选择 ABC 文本与 PDF 图像双模态生成问答评测,最强证据是文本问答约 49.44% 而视觉问答仅约 24.22%,代价是跨级全对的严格成功率迅速归零且微调仍难维持高层一致性。
论文把播放会话当句子训练跳元向量并用艺术家质心相减剥离歌手身份,以原始均值 0.2487 降至残差均值 0.0005 后仍有 4577 对跨歌手高相似为存在性证据,但自动播放混杂与重度用户偏差使结论止于信号存在而不及推荐性能。
针对巴洛克赋格主题的申克层次标注问题,AutoSchA 把乐谱建成多关系音符图并用节点隔离做可学习的逐层池化,在小样本专家数据上接近人类分析但仍残留可察觉的别扭连接且仅验证了该体裁。
针对只有音乐输入而缺乏动机控制的问题,MotivDance 用文本生成关键姿态作动机、自适应定位到音乐节拍再做扩散补间,在 AIST++ 稀疏关键帧上取得 FIDk 64.36 与关键帧误差 0.1211,但无关键帧时节拍对齐仍弱于部分基线。
论文用 13 年约 2 万首曲调的每周曲谱收藏数据比较中性、频率依赖与每首曲调自带适合度三类出生过程,发现方向性选择最强但多样性仍因新曲持续进入而上升,社会与旋律特征可解释适合度方差的 29%。
TimeCues Studio 针对多人整库音乐标注与算法迭代脱节的问题,用共享节拍网格加四类标记与多候选加关键度扩展方案统一标注与评测,并在 109 首电子音乐自建库与 3 首 CC0 演示库上走通全流程,代价是首次分轨与特征缓存开销大且算法建议仍需逐条人工复核。