论文解读

句末耳语为何锚定在重音之后:西班牙电视新闻的边界标记解读

该研究以 20 期西班牙公共台新闻中 417 个句末耳语为对象,检验说话人、重音位置与话语因素的制约,最强证据是耳语起点集中在重音及重音后音节而非话语转换,代价是样本仅两人两地口音且无声学参数建模。

 · 更新于 2026-09-24 · 约 17 分钟 · 8121 字 阅读 →
论文解读

阿姆哈拉语短语重音是边界还是节律头:窄聚焦与宽聚焦的证据

该研究以 16 名母语人的宽聚焦与问答及纠正性窄聚焦录音比较音高峰、词首强度与词尾时长,发现窄聚焦以后焦压缩和边缘增强为标志,宽聚焦中前动词宾语呈现边界前重置与增强,整体更支持边界增强而非普遍的节律重音。

 · 更新于 2026-09-24 · 约 18 分钟 · 8821 字 阅读 →
论文解读

基线先稳、顶线后变:3-5 岁普通话儿童自发话语中音高下倾的分化发展

该研究对 45 名 3、4、5 岁普通话儿童各 30 句自发陈述句提取整体回归线、顶线与底线斜率并以时长为协变量做 ANCOVA,发现底线在 3-4 岁间显著变陡后趋稳而顶线与整体线在 4 岁最陡,代价是样本小、时长不一、焦点类型未控且只有三个年龄点。

 · 更新于 2026-09-24 · 约 20 分钟 · 9861 字 阅读 →
论文解读

焦点在句首名词短语内部时,前置词为何要压低自己的 prominence

该研究以 19 名匈牙利母语者的 570 句朗读比较 A1、A2 与 N 窄焦点下的逐词 f0 走向,用 32.6% 与 50.8% 的前置非降调比例和焦点处更陡下降斜率支持 prominence reduction 解释,但感知验证与自发语泛化仍待补足。

 · 更新于 2026-09-24 · 约 16 分钟 · 7686 字 阅读 →
论文解读

做到了音高目标,却没衔接好过程:法语母语者普通话声调四一声连接的时序证据

该研究用中性焦点下三音节声调四一声一序列比较 8 名法语学习者与 8 名普通话母语者共 139 个样本,发现声调四下降幅度无组间差异而谷值提前与声调一中段下陷显著,支持困难在跨音节时序执行而非目标达成,但样本小且声调一平台高度仅呈边缘趋势。

 · 更新于 2026-09-24 · 约 16 分钟 · 7580 字 阅读 →
论文解读

句首鼻音变弱、句尾元音鼻化变弱:北京话声门开合与舌动作的时间竞争

该研究用鼻气流直接测量北京话音节首/n/与后随元音在句首、句中、句尾和孤立词中的鼻特性,发现句首/n/因时长压缩而总鼻气流下降、峰值提前,句尾元音总鼻气流下降但鼻比率升高,代价是样本仅 6 人且只覆盖/a,i,u/三个元音与固定载体句。

 · 更新于 2026-09-24 · 约 21 分钟 · 10166 字 阅读 →
论文解读

敬畏的声音为何又慢又轻又稳:单字韵律中时长、音高变化与共振峰稳定的分工

该研究用 31 名魁北克法语非演员的/papa/六情绪表演与 5 名专家听辨数据,结合 eGeMAPS 声学分析,报告敬畏表达更长、更轻、音色更暗且元音更稳,而听者把敬畏标签投给更长、基频变异更大、第一共振峰变异更小的声音,其中时长效应最强。

 · 更新于 2026-09-24 · 约 21 分钟 · 10074 字 阅读 →
论文解读

孩子把《戴帽子的猫》读得像大人吗:用词时长偏离度预测阅读理解

该研究以 91 名 6-10 岁儿童朗读《戴帽子的猫》的逐词时长为对象,用成人模型预测值与儿童实测值之差构造韵律错误分,报告了在控制年龄、语音意识和加工速度后韵律错误仍显著预测阅读理解标准分,但加工速度本身不显著且样本排除了无阅读能力和学习障碍儿童。

 · 更新于 2026-09-24 · 约 18 分钟 · 8944 字 阅读 →
论文解读

普通话焦点不是不会发,而是基频让位:自闭症儿童的声学线索再分配

该研究用句中焦点问答任务比较 15 名普通话自闭症儿童与 15 名年龄匹配典型发展儿童,显示典型组靠焦点音节基频提升加焦点后压缩标记焦点,而自闭症组基频使用受限、转而靠焦点后振幅与时长压缩实现区分,代价是焦点音节增强不足且模式随声调变化。

 · 更新于 2026-09-24 · 约 19 分钟 · 9195 字 阅读 →
论文解读

焦点后压缩与疑问上扬并存:昆明话如何同时标记强调与问句

该研究以 12 名昆明话母语者的 1152 个受控产出研究焦点与疑问语调的韵律编码,报告显示昆明话是焦点后压缩语言并以时长为最稳定线索,同时用全局抬升加句末上扬标记疑问且保留压缩,主要代价是句首焦点基频效应弱与强度仅起次要作用。

 · 更新于 2026-09-24 · 约 20 分钟 · 9687 字 阅读 →
论文解读

同样都带重音,波斯语三种焦点为何舌头和嘴唇动得不一样

该研究用电磁发音仪比较波斯语宽焦点、窄焦点和纠正焦点的元音发音动作,发现纠正焦点位移更大、速度更快、时长更长,窄焦点居中,并用发音音系学的手势目标与激活时长等参数解释差异。

 · 更新于 2026-09-24 · 约 18 分钟 · 8675 字 阅读 →
论文解读

绕口令里的加速与升调:口语流利自闭症儿童的性别差异与症状关联

该研究用朗读句与加速绕口令的任务差值比较口语流利自闭症与典型发育儿童的平均基频与语速,发现自闭症女孩加速与升调幅度最大,且症状越重任务差值越小,但该关联在男孩中更强,代价是样本小且仅覆盖两类韵律指标。

 · 更新于 2026-09-24 · 约 17 分钟 · 8317 字 阅读 →
论文解读

不用切分音节也能认词:连续韵律线索如何逐帧改写词竞争

论文用词即连续声学轨迹加听者线索权重的最小前馈模型复现英语首音队列、普通话声调分叉和意大利语重音延迟分化三类时程,代价是小词表演示且权重手工设定而非拟合人眼数据。

 · 更新于 2026-09-24 · 约 22 分钟 · 10791 字 阅读 →
论文解读

停顿次数追上母语者,停顿位置却走反了:二语普通话韵律的量质分离

该研究以 67 名普通话母语者与 67 名越南学习者共 13,802 句朗读为对象,用 C-ToBI 边界与依存句法对照检验主语谓语划分,发现高水平组在大短语 B3 数量上与母语者无显著差异,却在主谓 SBV 降级与动宾 VOB 升级上偏离更大,代价是层级倒置的化石化模板。

 · 更新于 2026-09-24 · 约 16 分钟 · 8006 字 阅读 →
论文解读

语言识别可解释了但判分还能用吗:BA-Lang 把嵌入变成可数属性

该研究把语种识别改写为二值语音属性上的独立伯努利似然,用二值自编码器加按频率估计的激活概率做闭集判分,在 FLEURS 上以 mms-lid-126 嵌入达到与 PLDA 相当的精度,同时保留按属性回看判分依据的能力,代价是在 ECAPA-TDNN 与未见语种上出现更明显的性能下降。

 · 更新于 2026-09-24 · 约 21 分钟 · 10511 字 阅读 →
论文解读

总时长没有区别时区别藏在哪里:donc 话语标记用法的分段与边界策略

以 95 次自发语 donc 比较话语标记与常规连词在口吃组与对照组的实现,显示总时长与整体不流畅分布无显著差异,而尾音/k/占比、前暂停与前音高跳变呈现组别与用法交互,但样本仅 18 人且只覆盖一个词。

 · 更新于 2026-09-24 · 约 22 分钟 · 10621 字 阅读 →
论文解读

声调中和下温州话高低调域为何不同时消失:位置、轮廓与年龄的线索重组

该研究以瑞安温州话双音节连读变调中仍为重音的音节为对象,用广义加性混合模型与线性混合效应模型检验基频、辅音时长与嗓音质量如何分别编码高低调域,显示词首基频仍强而词中减弱、元音间浊闭塞时长与元音起始段气嗓仍稳健,且青年组各维度区分均弱化,代价是跨调对的邻接声调未能完全控制故只能做调对内中和结论。

 · 更新于 2026-09-24 · 约 21 分钟 · 10148 字 阅读 →
论文解读

打码说话为何变慢:法语补码口语中音段时长与手动键结构的协同

本研究以五名熟练编码者的 2148 个 CV 键为对象,用线性混合模型检验词类、句内位置与朗读任务对辅音和元音时长的影响,发现说话人差异主导时长而常规语言学因素解释力不足,代价是模型仅解释约三成方差且编码语速整体慢于自然口语。

 · 更新于 2026-09-24 · 约 21 分钟 · 10394 字 阅读 →
论文解读

听得准的人一定说得清吗:普通话问句与陈述语调的感知与产出关联

该研究用 16 人录音与 8 名女性回访的二选一辨认任务检验普通话问句与陈述语调的感知产出关系,发现听自己更准、刺激中韵律区分度越大越好辨认,但听者自身区分度的作用只体现在问句与陈述的不对称偏移上且受声调制约。

 · 更新于 2026-09-24 · 约 17 分钟 · 8484 字 阅读 →
论文解读

用手指画出声调:非母语者能靠手势复现普通话声调对比吗

该研究用触屏界面 ToneCanvas 让 10 名母语者和 9 名无声调经验的法语者先描后默画 9 对双音节词的声调轨迹,发现总体对比幅度无显著组间差异但中段与 T2/T3 动态段存在局部差异,说明手势可支撑声调编码但快速变调控制仍是难点。

 · 更新于 2026-09-24 · 约 16 分钟 · 7727 字 阅读 →