合流者不拉开距离、清晰者主动靠近:粤语三六声调在对话中如何对齐音高区间
论文用十对多合流与少合流粤语者的无脚本密室游戏对话检验声调超音段适应,发现少合流者缩小三声与六声的归一化基频距离以靠近多合流者、两组在对话末尾对齐而前后朗读无变化,支持目标驱动的音高区间趋同而非简单的去合流模仿。
论文用十对多合流与少合流粤语者的无脚本密室游戏对话检验声调超音段适应,发现少合流者缩小三声与六声的归一化基频距离以靠近多合流者、两组在对话末尾对齐而前后朗读无变化,支持目标驱动的音高区间趋同而非简单的去合流模仿。
该研究把多语言音素识别器输出的国际音标序列接上单语种 n 元音位组合模型做闭集语种识别,在 FLEURS 上达到与近期声学系统可比的准确率,但音素识别错误率和解码对照显示该序列并非真正与语言无关。
该研究用 383 名法英双语人的朗读句和 VOCALISE 系统比较单语与双语条件下的似然比分数,发现双语比较显著压低相似度并削弱同一说话人优势,使同人跨语言分数向异人分数靠拢。
该研究以法语合成语音为对象,用强制对齐加共振峰提取得到元音空间面积、元音内离散和元音间距离三类指标,并在系统层用斯皮尔曼相关对照平均意见分,最强证据是元音间高度对比/a-i/与/i-E/在 F1 上显著相关而多边形面积不显著,代价是离散指标整体偏弱且结论限于单语料单说话人风格。
该研究针对越南语词尾不除阻的塞音/p,t,k/难以靠爆破辨认的问题,在 C1VC2 伪词载体句中测量元音后段共振峰与强度过渡,发现即使无爆破仍在 70% 后出现显著分化,但分析目前只限 5 名女性高调发音。
该研究在德语自发对话中比较同批说话人的两种焦点超清晰化做法,最强证据是 23/24 人收紧了音高重音与手势顶点的对齐而只有 10/24 人 steepen 了降调斜率,且人人至少用一种策略,代价是韵律单通道结论不稳定、需双通道联合判断。
该研究以普通话与西安话双元音为对象,用广义加性混合模型分离声调贡献并比较基频与第一共振峰极值对齐,再用函数主成分加随机森林只看第一共振峰预测四声,最强证据是跨说话人分类达到普通话 49% 与西安话 43%,代价是只覆盖两个双元音且未直接观测发音运动。
该研究让 36 位母亲在相同指认任务中分别对假想儿童和成人说话,发现对儿童元音更长、音高更高,且困难指认拉长时长、对儿童抵抗二次提及弱化,但音高不随困难升高而是抵抗了列表语调的下降。
该研究用英语为矩阵语、粤语为嵌入语的对比性焦点产出实验检验韵律层面的混合与超清晰化,报告切换词居中而切回后英语词出现类声调转折与更极端高低目标的主要证据与代价。
本研究在 45 名波士顿 AFAB 英语者中比较朗读与自发两种语域下的平均基频、基频范围、元音离散度和发音速率,报告自发语中女同性恋、双性恋与异性恋组间的系统差异在朗读中被中和,代价是语料量不平衡与整文件聚合掩盖个体与话题变异。
该文以增量重合成的时长、基频与滑音加 TIMIT 后验音素为探针,用核典型相关与记忆分类核对 Mimi 八个码本的分工,最强证据是时长可达 92.3% 而音高与滑音仅部分可恢复,且第一码本更偏向音段表示。
该研究同步采集 12 名巴西葡萄牙语朗读者的音频与下颌垂直位移,比较戏剧艺术组与普通组在散文和诗歌中的发音与下颌运动,发现实验组下颌降幅更大、变异更大、开口速度更快且整体强度变异更高,代价是语速更慢且样本仅 12 人、未做元音高度归一化。
本研究以 56 名 60-70 岁粤语正常认知老人的 EEG 回答 SCD 如何调节言语与音乐的皮层追踪,最强证据是扰乱言语在 theta 与平静音乐在 delta 和 theta 随 SCDS 加重而下降,代价是只在缺乏上下文或鲜明节奏的风格中显现且依赖多协变量校正的线性混合模型。
该研究用电磁发音仪测量意大利语四音节伪词中跨辅音元音间距,显示当其中一个元音带重音时元音到元音协同发音减弱且重读元音目标更极端,支持手势缪模型的作用域超出重读音节,但前向与后向效应的不对称仍受重音位置混淆限制。
该研究以 28 名母语者与汉语双语和三语学习者的朗读与半自发法语为对象,用六个节奏度量比较组别与任务交互,最强证据是元音度量随任务系统性上升而辅音度量保持稳定,代价是仅%V 与半自发下 Varco-V 显示组间偏离且语速未显式建模。
该研究让 27 名瑞典学习者和 14 名东京日语母语者读同一载体句中的双音节词,用音节时长和归一化调峰位置检验迁移,显示时长迁移只出现在首音节重读词而调峰提前出现在无重音与末重音词,且背景变量不能预测声学实现。
该研究以约 7 小时朗读与约 29 小时自发对话中 40 人的 36445 个/ai,au,ia,ua/为对象,用元音空间面积与混合广义加性模型刻画 F1-F2 动态轨迹,显示短时长引起局部中央化而口语语体引起整体轨迹下移且不改变曲率,代价是未报告可复现的切分与建模参数细节。
该研究以拉美人工智能微工人的半自发访谈为对象,用时长与频谱重心刻画词尾 coda /-s/ 的弱化,并在 4172 个保留样本上以线性混合模型检验教育、就业与收入的调节作用,但因样本小且只保留较长切分,结论只能视为待验证的趋势。
该研究以安大略西南部 12 人的朗读与会话语段为对象,用个人层面语言使用指数检验接触强度,发现发音速率随年龄在朗读中下降并随语段变长而加快且男性斜率更陡,而语言使用指数对速率无显著作用,只对语段长度显著,代价是小样本与不完全平衡限制了交互检验力。
该研究让 20 名德语母语者与 20 名法语学习者朗读两篇德语故事,用边界前最后两个重读音节基频最大值计算半音每秒斜率,报告标题处母语者下降更陡且间接引语仅母语者显著分化,代价是每人仅两个标题样本且间接引语依赖特定生僻动词。