时长学会了,音色还没分开:400 名法语者英语/i:/-/ɪ/的声学证据
该研究对 400 名法语母语英语学习者的/i:/、/ɪ/与法语/i/做时长与 F1-F2 重叠测量,发现时长差异总体显著但共振峰分布仍高度重叠,说明时长线索可被习得而不等于达到母语者式实现。
该研究对 400 名法语母语英语学习者的/i:/、/ɪ/与法语/i/做时长与 F1-F2 重叠测量,发现时长差异总体显著但共振峰分布仍高度重叠,说明时长线索可被习得而不等于达到母语者式实现。
该研究以常州话双音节名词与动词短语的声学比较检验左主导与右主导变调是否成立,最强证据是动词短语基调保留仅轮廓简化而名词短语出现大幅偏离与一词多调,代价是仅分析 3 名年轻女性发音人且单音节基线只在孤立语境录制。
该研究用口语词云重组任务检验形容词长度与介词短语类型对法语形容词前置率的影响,最强证据是长形容词主效应系数 -2.29 且名词补语与动词补语都提升前置率,代价是韵律模式仍在分析中且样本限于双音节名词与特定音节组合。
该研究把原来只给朗读打一个总分的可懂度模型改造为按轮次打分的时间序列方法,在 13 例舌切除患者的半结构化临床对话上检验临床医生说话是否影响患者下一轮可懂度,最强证据是 7 例中存在显著关联且 PMB01 约 40% 变化可被解释,代价是 10 秒窗导致的时间粒度粗糙且个体差异极大。
该研究以马赛市议会 10 名说话人各 5 段录音和 49 名听众的 5 级口音等级判断为证据,显示说话人均值从 1.33 到 4.10 呈近连续分布且重测相关 R²=0.98,而听众地域与态度变量均不显著,代价是 30 分钟在线测试流失率高且语音内容未做音系控制。
该研究用 40 个法语西班牙语非言语声音做四选一情绪识别,报告年龄越大识别越准、喜悦悲伤优于恐惧、非言语声优于句子、五岁双语儿童优于单语,但样本小且组间不均衡使语言效应只能算探索性发现。
该研究在/aCa/中用三维电磁发音仪对比/d/与/r/的舌尖手势,报告 3 人实现为近音、仅 S2 实现为拍音且/r/以更高闭合刚度缩短平台与声学收缩,代价是仅 4 人小样本且拍音证据集中于一人。
该研究把转写词错率当作后续音素对齐的前置条件,在未见过的健康与病理法语数据上比较四类系统,最强证据是训练数据与评测风格越接近误差越低,而代价是没有任何模型在犹豫词和不同病理间保持稳定。
该研究把单语和多语语音基础模型放在同一微调与分类流程下比较伪造检测,报告显示多语模型在域内和野外数据上更稳健,但超大规模参数并未带来系统性增益且单语模型在未知压缩与信道下退化明显。
该研究把成人 MonPaGe 工具中的交替运动速率任务适配给 2.6 至 6 岁法语儿童,在 97 名典型发育儿童首批数据上先做听觉语速测量,再转向三窗口声学测量加错误质性分析,初步报告任务类型与辅音丛显著影响表现,后续将对比健康老化与帕金森组以检验逆行发生假说。
论文把词入侵测试搬到说话人表示上,用 Top-K 稀疏自编码器从 ECAPA-TDNN 嵌入中抽出 500 维稀疏维度,再靠 22 人听辨找侵入者,结果显示只有噪声、口音和语言等少数维度可被人感知,而低典型性并不保证可解释,一致性余弦分数则与判对显著相关。
该研究以 9 名母语人的孤立词录音为对象,用自动对齐时长与振幅包络二次项系数证明 fortis /ŵ/ 更长且呈凸形能量凹陷,而 lenis /w/ 常弱化为过渡,代价是野外录音剔除、切分不确定与尚未覆盖 /j/ 对立。
该研究让三组帕金森患者分别接受适配音乐、随机音乐和无音乐的四周步态训练,用 30 秒 pataka 重复任务比较干预前后音节间期离散度,最强证据是音乐组节律离散度下降而无音乐组上升且整体音乐效应 p=0.018,代价是样本小且大量依赖 Praat 手工校正。
该研究以 21 名助听器佩戴者区分 ada 与 aga 的三线索权重和三种朝向的谱时调制检测阈为证据,显示第二共振峰线索利用与对应调制敏感性相关,但样本小且高频爆破条件多未完成使结论仍为相关性支持而非因果证明。
针对奥克语数据稀少且集中在加斯科涅和朗格多克方言的问题,论文比较直接微调、跨方言微调和两阶段微调,最强证据是两阶段在大资源方言上继续降低词错误率,而代价是小资源方言只能做迁移评估且测试集极小。
该研究在法语朗读任务中比较言语失用症、帕金森构音障碍、小脑性共济失调构音障碍与典型对照的韵律成组,报告显示三组都保留四级边界与两级节奏突显的清单但分布不同,而失用症组以过多边界和词内边界形成最碎的切分。
该研究用术后第 1 天六遍/apa/的相对基频比较 17 名健康对照、38 名术后无感知嗓音改变和 8 名术后嗓音障碍者,发现消退段组间差异高度显著但效应量小到中等,且不能区分两组术后患者,提示它是敏感但非特异的早期客观线索。
该研究以朗读控制文本比较健康人与上气道消化道癌症患者的静默停顿,报告患者停顿更多更长且混合功能为主,代价是生理约束加重与个体差异大,且原文未给出可复算的具体频次与时长数值。
论文要解决从文本生成法语 LfPC/提示语编码的教学工具缺失问题,选择把生成引擎与语言规则分离并暴露三步可核对流程,其证据是已验证的生成引擎与用户测试过的界面,而代价是美式英语长元音三维动作在二维显示上尚未优化。
该研究以 14 名西班牙语母语者为对象比较 8 小时单模态听觉训练与手势加 prosodie 多模态训练,报告显示手势组在语速、元音时长缩减与音域比扩展上占优,而两组在圆唇元音感知与产出上均无组别效应,且感知基线已高达 92%-95% 带来天花板限制。