自闭症儿童韵律不是单一偏离:跨芬兰语、法语、斯洛伐克语的音质与强度证据
该研究以芬兰语、法语、斯洛伐克语共 8212 个停顿间语段的 88 维 eGeMAPS 特征经主成分分析降维后用线性混合效应模型检验组别差异,最强跨语言证据是自闭症组整体强度变异更大、嗓音更清晰少气息、动态强度斜率与中心基频更低,代价是数据高度不平衡且法语单语建模无显著结果。
该研究以芬兰语、法语、斯洛伐克语共 8212 个停顿间语段的 88 维 eGeMAPS 特征经主成分分析降维后用线性混合效应模型检验组别差异,最强跨语言证据是自闭症组整体强度变异更大、嗓音更清晰少气息、动态强度斜率与中心基频更低,代价是数据高度不平衡且法语单语建模无显著结果。
该文把 17 个 Wav2vec 2.0、HuBERT 和 Whisper 模型统一微调为法语 35 音素识别器,先在 Common Voice 健康语音上建立基线,再冻结模型到 111 例 C2SI 病理语音上测跨域衰减与临床相关,最强证据是 Wav2vec 2.0 以 6,2% 错误率领先且错误率与人工评分高达 0,88 和 0,91 相关,但最低错误率 …
该演示针对精神科访谈中非正式韵律观察不可复现的问题,给出从录音到说话人分段、转写、音节定位再到时间韵律指标与人工核对的端到端流程,并以一段含 2 人 3 轮的示例说明可视化核对方法,代价是仍需人工复核且未报告定量精度与临床阈值。
该研究以二分类检测特发性帕金森病的运动性言语障碍为问题,用冻结的 Wav2Vec 2.0 XLS-R 加 128 维多层注意力分类头做跨库评估,最强证据是三库联合训练在未见过的 MDVR-KCL 上达到 85.3% AUC 并避免单库模型的跨库崩塌,代价是对低 UPDRS 评分和 OFF-DOPA 条件的患者仍明显更难检出且结果受随机划分影响大。
该研究在 46 人面对面自由讨论中比较自闭与非自闭组语调风格,发现起伏度和跨度均值无组差,但用香农熵度量 16 格分布多样性时自闭组更可预测,代价是该熵效应后验概率仅 0.88 且置信区间含零。
该研究让三组帕金森患者分别接受适配音乐、随机音乐和无音乐的四周步态训练,用 30 秒 pataka 重复任务比较干预前后音节间期离散度,最强证据是音乐组节律离散度下降而无音乐组上升且整体音乐效应 p=0.018,代价是样本小且大量依赖 Praat 手工校正。
该研究在法语朗读任务中比较言语失用症、帕金森构音障碍、小脑性共济失调构音障碍与典型对照的韵律成组,报告显示三组都保留四级边界与两级节奏突显的清单但分布不同,而失用症组以过多边界和词内边界形成最碎的切分。
该研究用术后第 1 天六遍/apa/的相对基频比较 17 名健康对照、38 名术后无感知嗓音改变和 8 名术后嗓音障碍者,发现消退段组间差异高度显著但效应量小到中等,且不能区分两组术后患者,提示它是敏感但非特异的早期客观线索。
该研究以朗读控制文本比较健康人与上气道消化道癌症患者的静默停顿,报告患者停顿更多更长且混合功能为主,代价是生理约束加重与个体差异大,且原文未给出可复算的具体频次与时长数值。
该研究用单音节极性问句与陈述句考察唐氏综合征成人的基频动静态特征,以逐人广义加性混合模型比较经四人一致听辨筛选的 58 条唐氏综合征曲线与 144 条对照曲线,发现多数人能产生可辨认的上升与下降轮廓但个体差异大、陈述句缺测多,女性唐氏综合征组最大基频偏低而均值相近,与既往偏高基频的报告不一致。
本研究以 56 名 60-70 岁粤语正常认知老人的 EEG 回答 SCD 如何调节言语与音乐的皮层追踪,最强证据是扰乱言语在 theta 与平静音乐在 delta 和 theta 随 SCDS 加重而下降,代价是只在缺乏上下文或鲜明节奏的风格中显现且依赖多协变量校正的线性混合模型。
该研究用 11 个声学参数加随机森林区分女性双侧声带小结与健康嗓音,最强证据是声调 3 模型准确率 0.836 与 AUC 0.902,代价是仅覆盖女性北方官话单字朗读且未验证连续语流与男性泛化。
该研究以标准化朗读任务的时间声学测量为输入,用主成分分析加层次聚类找出慢而分段与快而连续的第一维度和节律规整性的第二维度,得到 5 个与疾病分期和感知严重度不完全对应的口语轮廓,但样本小且仅用时间测量因而不能单独判定临床严重度。
该研究以 17 例肌张力障碍患者术前与术后 6 个月、12 个月的文本朗读为对象,用混合线性模型检验韵律声学参数变化,报告仅平均基频在术前与术后 12 个月之间显著不同,其余参数稳定,作者将其解读为无韵律层面的整体改善但也无有害效应。
该研究用朗读句与加速绕口令的任务差值比较口语流利自闭症与典型发育儿童的平均基频与语速,发现自闭症女孩加速与升调幅度最大,且症状越重任务差值越小,但该关联在男孩中更强,代价是样本小且仅覆盖两类韵律指标。
以 95 次自发语 donc 比较话语标记与常规连词在口吃组与对照组的实现,显示总时长与整体不流畅分布无显著差异,而尾音/k/占比、前暂停与前音高跳变呈现组别与用法交互,但样本仅 18 人且只覆盖一个词。
该研究用自适应低通滤波去掉可懂语义后,比较 33 名评分者对 25 人语音的韵律判断与 108 个声学时序特征训练的逻辑回归分类器在 251 人数据上的表现,两者准确率均为 80.0%,代价是灵敏度中等且韵律标记与症状总分无显著关联。
该研究把 Prosody Assessment 的 8 个接受性与 4 个表达性子测验搬到远程 Qualtrics 上,用 224 名 4-13 岁典型发展儿童和 48 名 4-17 岁自闭症儿童检验年龄敏感性与组间差异,最强证据是典型组除表达性升降调外均随年龄显著进步而自闭症组在情感与语用子测验上显著落后,代价是无常模、表达性评分标准模糊与部分任务存在文化 …
该个案以四组同音节五声调重复任务结合五位母语听辨与基频时长声学测量,显示总体听辨正确率仅 36.1% 且高调 T1 仅 6%,代价是单被试、无纵向干预对照,不能推广为群体规律。
该研究用图片描述语音的声学流畅性与文本流畅性双路特征加注意力多示例学习,在 742 人 SONIVA 语料上不依赖影像预测中风状态、偏侧、体积三分级和 12 个半球脑叶受累,并报告左半球偏文本、右半球偏声学的特征依赖梯度与定位性能差距。