纠缠托底差距:用三轴合成网格审计并解耦音频表征的人口公平性
该文用 120 文本×24 声音画像×10 风格的合成正交网格审计 10 个开源音频编码器与 2 个闭源语音问答系统,以主夹角泄漏解释探针差距并用正交残差对比适配器降低泄漏与差距,代价是需要合成感知属性假设与额外适配训练。
该文用 120 文本×24 声音画像×10 风格的合成正交网格审计 10 个开源音频编码器与 2 个闭源语音问答系统,以主夹角泄漏解释探针差距并用正交残差对比适配器降低泄漏与差距,代价是需要合成感知属性假设与额外适配训练。
针对 5 分钟以上医患对话直接生成 SOAP 病历的问题,论文用统一端到端架构比较 3B 轻量与 30B 重量模型,报告四阶段训练把 Concept F1 从零样本的 0.26 和 0.18 分别推到 0.4082 和 0.5167,并以级联基线为对照说明直接优化的收益与容量代价。
口语讽刺检测难分词汇与韵律贡献,CLASH 用同一句话的四条件配对变换固定模型做反事实审计,最强证据是目标句 Qwen3-Omni 在时长平衡后词汇保留领先韵律保留 0.135 至 0.148 的 AUROC,代价是声学分数移动常不带来判别增益与二值判决变化。
共收录 118 篇 jep-2026 会议论文的 Reader 深度解读
共收录 188 篇 speechprosody-2026 会议论文的 Reader 深度解读
该研究用视觉世界眼动范式检验英语真诚与反讽韵律的实时加工时间进程,发现韵律类型主效应不显著,而基频升高预测更多看向真诚目标、基频与谐噪比升高预测更少看向反讽目标,但初始注视偏置与刺激问题使交互式与模块式之争仍无定论。
该研究用窄焦点语境下的四种语序×语调组合做合适度评级,检验韵律能否独立标记动词后窄焦点以及窄焦点语序是否必须配典型语调,最强证据是典型窄焦点得分最高但三类错配仍可接受且与基线无显著差异,代价是丰富词汇语境可能掩盖了线索在信息不足时的真实权重。
该研究用荷兰语预测性句尾词汇判断任务检验节拍手势是否加速词汇通达,最强证据是噪声下真词反应时加快约 122 毫秒和 124 毫秒并使正确率提升约 4 个百分点,代价是手势与词重音是否对齐始终未产生可靠的交互作用。
该研究用句子图画验证任务检验 31 名 6 到 8 岁普通话儿童对主语韵律和宾语韵律的理解,发现韵律条件主效应显著但个体在韵律线索与句末位置线索之间的权重差异很大,且工作记忆 digit span 未能解释这种差异。
该研究从非正式播客访谈中抽取希腊语是非问句,用核音调标注加时间序列聚类与函数主成分分析,显示核重音类型不由偏向唯一决定,而肯定偏向对应整体更高的基频,且该效应在很大程度上独立于具体调型。
该研究用听觉启动加默读选择任务检验含 only 歧义句的信息结构启动,报告显示动词重音启动提高了非常见动词关联选择,而去词汇与自然启动的效果差异取决于工作记忆与听觉想象等个体差异,但总体启动并不稳定且代价是条件依赖性强。
该研究用无语境听辨任务检验普通话四类字面与反语的韵律感知,发现反语批评正确率较高而反语表扬极低,且自闭特质量表得分越高反语表扬越差,但样本仅 20 人且为单一女声录音。
该研究用完整与缩减形式的词汇启动任务检验法语学习者对英语 schwa 脱落的表征问题,初步报告显示缩减启动词降低正确率且效应随水平增强,支持缩减形式经由完整形式生成而非等价存储,但样本小且未报告可复算的定量主效应表。
该研究用 Markina 巴斯克语中性陈述与是非问听辨任务检验母语与西语为母语的二语听者,显示母语者四条件均高于 95% 而二语者在多短语问句仅约 24% 正确、在单短语陈述约 61% 正确,说明核轮廓之外的整体音高形状决定问句解读。
该研究用英语升降调最小对的启动词汇判断任务检验五种母语背景听者是否把音高形状当作词义线索,发现普通话听者呈现稳定的降调优势、韩语听者仅在完全匹配时呈现小效应、法语日语和英语听者无效应,说明音高抑制取决于母语功能映射而非简单的首重与边重二分。
论文用标量问答的歧义回答检验韵律焦点如何引导肯定或否定推断,以连续声学测量预测听者是跟随形容词还是名词含义,最强证据是形容词峰值基频与名词时长方向相反的作用,代价是词类、位置与句末语调纠缠且只覆盖标量形容词语境。
该研究用 2×2×3 的语境问答评分任务检验普通话母语英语二语者如何权衡 H* 重音与裂句,主证据是裂句与问题类型交互显著而重音无可靠效应,代价是仅用离线评分且缺乏母语对照。
该研究用音段与声调完全相同的十二对最小对立句比较母语者、传承语者与晚学二语者的听辨准确率与反应时,发现母语者最快最准且传承语者总体未显著超过二语者,但传承语者在强弱边界的影响方向上更接近母语,代价是弱边界仍带来准确率下降与额外耗时。
论文以天津话嘛的疑问与否定两读为对象,用感知辨义与诱导产出两组实验说明无句法语境线索时存在真歧义,而时长、音强、最大基频与基频域等韵律线索可部分补足区分,但加工更慢且分布因有无句法标记而转移。
该研究用德语 L+H* 重音与去重音对比的听觉词汇判断任务检验韵律突显是否加速词汇通达,最强证据是 50 名被试中两条件平均反应时几乎相同且混合模型无显著效应,代价是结论仅限于无信息结构支撑的孤立词识别阶段。