一个因果音频到脑电模型如何同时复现脑干、皮层与双耳整合响应
该研究把双耳声波形直接映射为连续高采样率脑电,用约 250 小时异构数据训练一个因果编码器解码器,并在并行脑干响应、语音时间响应函数与双耳交互成分三类范式上复现了已知的形态与刺激依赖效应,但串行呈现幅值与部分响应幅度仍存在系统性偏差。
该研究把双耳声波形直接映射为连续高采样率脑电,用约 250 小时异构数据训练一个因果编码器解码器,并在并行脑干响应、语音时间响应函数与双耳交互成分三类范式上复现了已知的形态与刺激依赖效应,但串行呈现幅值与部分响应幅度仍存在系统性偏差。
针对双人竞争听觉注意解码中短窗 Fisher-z 相关方差大、单尺度无监督 GMM 难分 attended 与 unattended 分量的问题,论文提出跨 8 种窗长共享均值、方差按 1/(N_L-1) 缩放的多尺度 GMM 联合估计 HMM 发射参数,在 72 分钟全量下 1 秒窗提升 1.82 个百分点、在 6 分钟数据下提升 8.32 个百分点,但数 …
共收录 60 篇 icmc-2026 会议论文的 Reader 深度解读
共收录 118 篇 jep-2026 会议论文的 Reader 深度解读
共收录 188 篇 speechprosody-2026 会议论文的 Reader 深度解读
该文追问法语重音短语如何切分,提出以连续重读音节间最小约 250 毫秒、最大约 1250-1350 毫秒为时长约束,并以脑电 delta 振荡 0.8 Hz 到 4 Hz 作机制解释,代价是长词与快慢语速下的切分不再唯一依赖句法或音节数。
Hyponoia 针对开放形式电声即兴中生理信号如何参与音乐形式的问题,用 Muse 2 四通道脑电加心率的闭环状态机把神经振荡映射为作曲过程,并在 4 人大小提琴与小号对比中显示声音实践专家有更丰富连贯的 theta 与 alpha 活动,代价是样本极小且阈值与伪迹处理未经充分验证。
该工作把已训练好的三维想象运动解码器的连续速度信号作为声音手势的控制源,用分层颗粒合成做实时可听化,报告了静息、起始与持续手势的可区分听感,但尚未做闭环听觉反馈下的受试者评估。
本研究以 56 名 60-70 岁粤语正常认知老人的 EEG 回答 SCD 如何调节言语与音乐的皮层追踪,最强证据是扰乱言语在 theta 与平静音乐在 delta 和 theta 随 SCDS 加重而下降,代价是只在缺乏上下文或鲜明节奏的风格中显现且依赖多协变量校正的线性混合模型。
该研究以法语重音短语为节奏单位,用脑电的成对相位一致性检验三角波跟随语速的能力,初步显示老年人在三倍速下耦合消失并伴随理解与复述分数下降,但神经证据目前仅为每组一人的试点分析,须等待六十人规模的完整处理来确认。
共收录 160 篇 nime-2026 会议论文的 Reader 深度解读
该研究用被动听觉奇异范式与脑磁图比较 24 名普通话-英语双语者与 21 名单语者,发现双侧颞上回与左侧颞中回出现声调偏离的失匹配场,双侧颞上回的双语者效应更强而只有左侧颞上回显示跨语言同音词特异效应,代价是无个体核磁、模板头模型与只报告组水平失匹配幅度的局限。
该系统用 Muse S Athena 头环采集脑电频段经 Mind Monitor 以 OSC 送入 Csound,以采样保持加 SATB 查表把生理抖动驯成稳定和声并用 MIDI 键盘做移调与乐句控制,在双人互换脑电的现场二重奏中验证了可演奏性,代价是放弃连续调制精度且未做定量听感与延迟测量。
共收录 127 篇 eusipco-2026 会议论文的 Reader 深度解读
该研究把管弦乐引子与静息任务态脑电都转成时间序列做复发分析,用层流性、确定性、复发率和缺隙度刻画动力学组织,并提出局部密度相似性做音乐与脑电复发图的跨比较,最强证据是贝多芬引子与健康脑电的平均局部密度相似性下降最大而柴可夫斯基最小,代价是仅两例被试与首 60 秒音乐的探索性小样本。
针对双说话人竞争下脑电信噪比低而窗级解码在分辨率与精度间折中问题,论文用马尔可夫切换模型把包络回归与注意状态转移联合建模并用 EM 逐采样点估计,在 KULeuven 数据上取得与 HMM 后处理相当的中位精度而中位切换检测延迟显著更短,代价是对初始化敏感且仍依赖线性回归假设。
该研究用三模型对比学习加包络重建做跨被试听觉注意解码,在 24 人移动脑电三种自然范式上 2 秒窗 61.4% 到 30 秒窗 79.1%,代价是依赖 5 秒训练窗与多特征音频编码且短窗绝对精度仍有限。
共收录 147 篇 aaai-2026 会议论文的 Reader 深度解读
共收录 199 篇 acl-2026 会议论文的 Reader 深度解读
该研究用会话对齐加 Conformer 加 CTC 直接从皮层神经活动解码字符序列,在验证集上报告字符错误率为 23.80%,代价是跨会话信号漂移仍大且词边界错误集中。