普通话双元音为何变短就变中央化:时长与语体如何分工压缩共振峰轨迹
该研究以约 7 小时朗读与约 29 小时自发对话中 40 人的 36445 个/ai,au,ia,ua/为对象,用元音空间面积与混合广义加性模型刻画 F1-F2 动态轨迹,显示短时长引起局部中央化而口语语体引起整体轨迹下移且不改变曲率,代价是未报告可复现的切分与建模参数细节。
该研究以约 7 小时朗读与约 29 小时自发对话中 40 人的 36445 个/ai,au,ia,ua/为对象,用元音空间面积与混合广义加性模型刻画 F1-F2 动态轨迹,显示短时长引起局部中央化而口语语体引起整体轨迹下移且不改变曲率,代价是未报告可复现的切分与建模参数细节。
该研究以拉美人工智能微工人的半自发访谈为对象,用时长与频谱重心刻画词尾 coda /-s/ 的弱化,并在 4172 个保留样本上以线性混合模型检验教育、就业与收入的调节作用,但因样本小且只保留较长切分,结论只能视为待验证的趋势。
该研究以安大略西南部 12 人的朗读与会话语段为对象,用个人层面语言使用指数检验接触强度,发现发音速率随年龄在朗读中下降并随语段变长而加快且男性斜率更陡,而语言使用指数对速率无显著作用,只对语段长度显著,代价是小样本与不完全平衡限制了交互检验力。
该研究用塞音加响音或阻塞音的首辅音丛与塞音加央元音加辅音的对照做知觉辨别任务,发现普通话母语者对塞音加 r 的修复与塞音加 s 相当而显著多于塞音加 l,支持拼音 r 在音系上表现为阻塞音而非响音,但刺激中约 78% 的 r 实现仍接近元音性声学特征,提示知觉归类更多由音系地位决定。
该研究让 20 名德语母语者与 20 名法语学习者朗读两篇德语故事,用边界前最后两个重读音节基频最大值计算半音每秒斜率,报告标题处母语者下降更陡且间接引语仅母语者显著分化,代价是每人仅两个标题样本且间接引语依赖特定生僻动词。
该研究以 13 名初学英语母语者为对象比较 7.5 小时显式形式聚焦与隐式意义聚焦教学,用三选一感知任务检验词重音时延长短和疑问句末调,结果总体无显著净增益,但显式组在词重音识别上更稳定而隐式组在疑问句语调选择上略有松动,代价是样本小、训练短且感知只是间接目标。
该研究以 45 名 3 至 5 岁儿童的 1350 句自发陈述句检验长度、词汇多样性和句法复杂度对音高范围与音高标准差的影响,发现复杂度一致扩大音高范围而仅 3 岁组显著变不稳定,4 至 5 岁转向更窄更稳的策略,代价是横断面设计与呼吸语速等机制未直接测量。
该研究以同一批配音与跟读语料切分句内非模态段并比较职业声优与学员,报告职业组约 90% 话语含非模态段且气声偏句尾、粗糙挤压偏句首句中,三类声学参数在两组人中趋势一致,但学员整体出现率更低且多用清吸气。
论文追问五音节名词短语在青年上海话中切分为 2+3 后低音目标是否重插,通过 8 人朗读与基频轨迹比较显示切分成立但全句只在第 5 音节约 70% 处收敛为单一低目标,而代价是前部二音节不再收敛且切分块整体音高高于孤立读法。
该研究用同一句英语比较九名普通话背景者的下颌位移比与声学元音起点对齐,发现最低熟练度者呈弱强式结尾加重而最高熟练度者呈强弱式,但所有人的下颌开口峰速度都最靠近声学元音起点,代价是样本小且仅用一句控制元音的朗读句。
本研究用单音节产出、保持与归一化时长的感知和语料分析说明,原长下二三声并不比其他声调更易混,混淆升高主要来自时长归一化,且长短时长分别对应降升与低降两种三声变体。
该研究在普通话六个单元音乘以四个声调的单音节词上比较基频与嗓音质量声学参数,发现闭元音比/a/更规则而三声与四声的扰动效应因元音而异,但样本小且仅量化分析女性数据。
该研究用粤语六声最小对的 AX 辨别任务检验口罩与噪声影响,发现戴外科口罩条件下的辨别灵敏度更高,贝叶斯因子 BF10 为 67.37,而声学分析显示口罩未显著改变基频相关线索,代价是结论限于辨别任务与外科口罩。
该研究用 5 对早闭合与晚闭合歧义句的朗读语料比较母语者与三组中国学习者,报告显示母语及中高级学习者用边界前元音的基频上升与时长拉长区分边界而初学者不能,代价是初学者的理解、节奏分组与语速条件不足。
该研究用下一轮回答与听辨到的辅音拉长作为非韵律筛选标准,从 8 名东伦敦加勒比裔青少年的半自发访谈中得到 192 个可用目标,并报告极问句 84%、陈述问句 64%、强调辅音拉长 79% 为升降调,而细部 F0 差异小且分布高度特异。
该研究以一段 8 分 35 秒德语 TED 演讲为样本检验累积线索与补偿线索两种假设,发现有重音和特强音节更易伴随手势且手势更强、强手势顶点更贴近重音音节,但核前重音反而比核心重音更易引出手势,代价是单说话人、小样本且特强样本稀少。
该研究用原声与平坦基频两版重音回忆任务检验泰语重音是否词汇存储,最强证据是保留基频时回忆接近荷兰语水平而去除基频后显著恶化,代价是平坦刺激自然度下降与样本量较小。
该研究用 30 人模仿五种核音调的实验检验核前非重读音节上的基频轨迹如何实现,报告了晚起上升与线性上升在模仿中合并、平台刺激未被复现、上升均在重音附近启动的证据,代价是仅覆盖六音节短语和实验室模仿条件。
论文用单篇民间故事田野录音比较动词前宾语与动词后宾语,发现后者在平均强度、平均基频和基频滑音幅度上显著更低而动词不受语序影响,该模式支持非突显成分易后置的解释,代价是时长无显著差异且信息状态效应只在合并语序时显著。
该研究以呼吸组为单位比较纯语言模型与加入呼吸的模型,报告吸气深度显著预测短语划分与基频变化且成人效应更强,支持交际需求驱动呼吸而非肺容量约束决定韵律,代价是音高重置几乎无呼吸效应且儿童数据剔除比例更高。