英文题目:The Role of Context and Prosody in the Understanding of English Irony by Chinese L2 Learners

会议身份:conference:interspeech:2026:conference-paper-id:lin26b_interspeech

来源为官方会议 PDF;图片依据原页像素,表格数字依据原文引用。PDF 文字层不视为原始 TeX,未可靠恢复的结构不作推断。

会议来源:官方记录 · 官方 PDF

标签:#心理声学实验 #韵律 #言语感知 #语音 #口语理解

评分:5.2/10 | 创新 1.2/2 | 技术严谨 1.1/1.5 | 实验充分 0.8/1.5 | 清晰度 0.8/1 | 影响力 0.7/1.5 | 开源 0.0/1.5 | 可复现 0.3/0.5 | 工程/实践 0.3/1.5

排名:后50% | 文档类型:应用研究

👥 作者与机构

  • Yinan Lin:机构信息未能从会议 PDF 纯文本可靠映射
  • Shanpeng Li:机构信息未能从会议 PDF 纯文本可靠映射

📌 核心摘要

该研究处理英语二语反语理解任务,输入为语境音频加目标句音频,输出为反语与真诚二选一判断及反应时,难点在于字面褒义与批评意图冲突且线索权重不明。为此先构造固定句式目标句并嵌入强不一致、模糊与无不一致三类语境以控制期待违背程度。接着由真人录制反讽、中性与真诚三种韵律并经效度筛选保留刺激,其输出直接作为感知实验的材料。最后用PsychoPy先呈现语境再呈现目标句并采集判断比例与反应时,输入混合模型检验语境、韵律与水平主效应及交互。相对已有单线索二语研究的关键差异是同时操控语境与韵律并检验水平调节,实际意义在于区分主导线索与补偿线索以指导教学。在模糊语境条件下,反讽韵律的反语判断率指标为75.47%,高于真诚韵律的反语判断率指标10.97%。该结论适用边界受限于字面表扬型反语与程式化录制语境,字面批评型反语、自然对话与自发韵律等外推尚未验证。原文未披露训练、推理或部署成本。

🔗 开源与复现资源

本次未形成可展示的已核验资源记录,开放状态尚未核实。 可达状态仅表示本次链接检查结果,不代表许可证、本文权重或运行复现已验证。

🧭 深度解读

输入是什么:要解决的反语听辨问题是什么?

本篇解读的输入是论文原文证据与官方原图像素,目标是让刚进入语音或二语习得领域的研究生能够核对方法并复述流程。必须保留的信息包括被试构成、语境与韵律的三水平设计、刺激录制与筛选方式、呈现流程、因变量与统计模型,以及主效应和交互的关键数字,输出是 1 篇按学习依赖展开的中文技术解读。

反语在这里指字面是表扬、实际是批评的话语,白话说就是明褒暗贬。论文研究的是中国英语学习者听英语反语时,上下文故事和说话人声音各自起了多大作用。日常交流中这类话常用于幽默、批评或讽刺,难点在于字面义与说话人意图相反,听者必须借助额外线索才能选对解读。对二语听者,困难还多一层:语用知识有限,母语与英语在语音实现上也可能不同。

因此任务不是把一句话的音频丢给模型就结束。同一句 Your paper is really well-written! 在不同前文下可以是真诚表扬,也可以是批评;同一前文下用不同语气读出来,倾向也会变化。研究要回答的是相对贡献问题:语境不一致程度是不是更基础的线索,韵律是不是在语境模糊时才显著补位,以及英语水平是否调节这种使用方式。后续各节先讲相关路线,再走完从样本到判断的完整链路。

已有路线在争什么:语境主导还是韵律够用?

母语反语研究已经形成两条线索的争论。一条强调语境不一致的中心地位,认为期望与现实的落差越大,越可能触发反语解读,失配程度直接影响判断比例。另一条关注韵律能否独立提示说话人态度和立场,有研究认为仅凭声音就能区分反语与非反语,也有研究认为没有语境支持时韵律不够用。当两种线索同时可用时,分歧继续存在:有人主张语境起主要作用,有人提出韵律是更省力的捷径。

在二语一侧,论文梳理的要点是学习者常感到困难,影响因素包括反语类型、文化背景、语言水平、语境和韵律。其中语言水平的作用最有争议:有的报告高水平者更善于发现字面义与语境的错配,有的发现水平与反语检出相关很弱或无关。这意味着不能默认水平越高反语听得越好,需要直接操纵线索并比较权重。

本研究的定位是系统比较语境与韵律的相对权重,并检验水平效应。它沿用语境加语调的经典思路,但把被试换成中国英语学习者,把语境分为强不一致、模糊、无不一致,把韵律分为反语、中性、真诚,从而在同一批材料上观察主效应与交互。教学例子:好比先固定一句话的字面褒义,再分别换故事背景和换读法,看听者翻转判断的比例如何移动。

要检验的具体预期是什么?

论文提出 3 个可检验的预期。第一,语境起主导作用,强不一致语境下的刺激被判为反语的比例应明显高于模糊语境和无不一致语境。第二,韵律促进反语感知,尤其在语境模糊时,反语韵律下的反语判断应明显高于中性韵律和真诚韵律。第三,语言水平不是理解反语的关键因素。

这里的因变量有两个:反语判断比例和反应时。前者回答选哪一边,后者回答选得多快或多难。判断任务采用二选一迫选,按 f 键表示批评和否定,按 j 键表示表扬和肯定,不限时但要求尽快并综合所有可用信息。反应时分析可以揭示线索一致或冲突时的加工代价,例如一致组合是否更快,不一致或模糊组合是否更慢。

需要提醒初学者:预期不等于结论。语境主导需要在 3 个韵律下都看到语境梯度,韵律补位需要在模糊语境下看到韵律梯度最大,水平不重要需要看到水平主效应不显著且交互有限或只出现在局部条件。下一节先给出方法全景,再逐段拆解构造与执行细节。

方法全景:一个试次走完哪些环节?

先沿一个样本走完输入到输出。被试先听到一段语境音频,同时屏幕呈现语境文字;经过 500 ms 红十字加提示音的间隔后,听到目标句音频,此时屏幕不再呈现目标句文字;然后按键判断是反语还是真诚。部分试次后还有与语境信息相关的理解题,用于促使被试认真加工前文。正式实验每人 54 个刺激,每个条件 6 个,另有 9 个练习试次。

材料侧的构造是 61 个字面表扬的目标句,句式固定为 X+be+really+adj.,平均长度 5.1 个音节,例如 Your paper is really well-written!。每个目标句嵌入 3 种语境,分别诱发反语、模糊和真诚解读;每个语境句对又用 3 种韵律产出。全部组合原本是 549 对刺激,经知觉验证剔除后保留 486 个英语刺激用于正式实验,对应 54 个场景乘以 3 种语境乘以 3 种韵律。

平行约束满足模型 × 关联理论: 平行约束满足模型主张多种线索同时快速累积直到证据足够,关联理论强调解读话语需要进行心理状态归因;二者搭配的理由是前者解释语境和韵律如何并行加权,后者解释为什么模糊时需要更多推理努力,组合意义在于同时说明选择结果和反应时快慢。

分析侧把反语判断比例和反应时送入广义线性混合模型,固定效应为语境、韵律和水平,随机效应为被试和句子,用第二类 Wald 卡方检验主效应与交互,显著交互后用 Tukey-HSD 事后比较,并用紧凑字母显示标记差异格局。字母相同表示差异不显著,字母不同表示差异显著,这是读图时理解柱顶字母的关键。

语境与目标句如何构造:冲突从哪里来?

语境构造遵循话语补全任务范式,但做了风格化处理以保证实验对比清晰,而不是完全复刻日常对话。强不一致条件的上下文与字面陈述直接冲突,形成明显的反语场景;无不一致条件上下文与陈述一致,形成真诚解读;模糊条件用中性上下文允许多种解读。这种三分法把语境从有无变成程度,为检验语境梯度提供条件。

目标句全部是字面表扬的陈述句,固定句式减少了句法和词汇差异的干扰。初学者容易忽略的一点是:字面褒义是设计前提,只有字面一致为褒,后续把判断翻转为批评才能算作反语效应。如果目标句本身有贬义词,判断逻辑就会混乱。论文把平均长度和句式都固定下来,正是为了让语境不一致成为唯一被操纵的文本变量。

语境不一致 × 反语理解: 语境不一致指上下文描述的事实与目标句字面褒义之间的冲突程度,反语理解指听者把字面表扬判定为批评和否定意图的决策;二者搭配的理由是冲突越强,字面义越不可维持,听者越需要启动反语解读,组合意义在于把语境从背景信息变成可分级的触发条件。

语境音频用 TTSMAKER 的美国英语男声以中性情感生成,严格保持嗓音、语速和韵律在语境条件下恒定。所有合成文件统一处理为 44.1 kHz、16 bit 的 WAV 文件。这样做的安排理由是隔离语境不一致的作用,避免语境录音自身的语气泄露答案。缺项是论文未报告合成语音的自然度评分,复现时只能按相同工具和参数重做并自行检查可懂度。

韵律如何录制与筛选:声音差异可信吗?

目标句由 1 名 22 岁的英语母语女性录制。流程分两步:先在不呈现语境时读出中性韵律,再在给定语境信息后按自己对语境和句子的理解读出反语或真诚韵律。录制时既不指导也不给反馈,音频保存为 44.1 kHz、16 bit 的 WAV 文件,并用 Praat 归一化到 70 dB。归一化控制了响度差异,使韵律差异更可能来自音高、时长和音质等实现,而不是单纯声音大小。

为保证声音确实被感知为预期韵律,论文做了知觉验证:4 名女生听全部刺激并在 5 点量表上评价批评或表扬程度。按评分剔除每种韵律下评分最低的 7 个条目,对中性条目同时剔除最低和最高,最终保留 54 个场景的材料。这个筛选动作很重要,它把录制意图变成可感知的类别,避免用录制标签代替听感。

反语韵律 × 中性韵律: 反语韵律指说话人为表达批评而产生的特定语音实现,中性韵律指不带明显褒贬倾向的基线读法;二者搭配的理由是只有把反语韵律与中性基线对比,才能分离出声音本身带来的增量,组合意义在于判断韵律是独立信号还是只在语境不足时起作用。

复现时要注意说话人单一带来的边界:只有 1 名女性录制目标句,结论不能直接推广到不同性别、年龄或口音。论文未报告具体的声学参数切分,例如音高均值或语速数值,因此不能从韵律标签反推某个阈值。能复述的是流程:中性先录、无指导再录、响度归一化、独立评分筛选,这是保证韵律条件有效性的完整链条。

本研究有没有训练模型:真实计算过程是什么?

本研究没有训练神经网络模型,也没有更新任何模型权重,因此不存在优化器、梯度路径、参数冻结或早停等训练环节。把无训练等同于确定性求解是误解:人的判断本身有变异,统计结论依赖随机效应和事后比较,不能从没有训练直接推出输出确定。

真实计算过程是行为实验加统计建模。行为侧调用 PsychoPy 2024.1.4 在计算机教室呈现刺激,用 OX83-355 电脑和 ECD-69 耳机,整个过程约 40 分钟。统计侧在 R 中运行广义线性混合模型,固定效应为语境、韵律和水平,随机效应为被试和句子。显著交互后用 emmeans 包做 Tukey-HSD 两两比较,再用 multcompView 包生成紧凑字母显示。

C-测试 × 语言水平分组: C-测试指按隔词删后半的完形填空计分方法,语言水平分组指按平均分把被试分为高低两组的操作;二者搭配的理由是需要把连续分数变成可比较的组间条件,组合意义在于检验水平是否调节语境和韵律的使用,而不是只报告相关系数。

水平测量用 C-测试,共 5 篇难度不一的短文、100 个空,每篇 20 分,按隔词删后半的规则计分,答对一空得 1 分。48 名本科生平均 66.60 分,标准差 13.52,按平均分分为高低两组各 24 人,高组均值 77.50,低组均值 55.71,差异显著。这里的计算只是分组依据,不是模型训练,复现时应保留原始分数分布并报告分组阈值,而不是只报告高低标签。

被试与流程条件是否一致:复现先对齐什么?

被试为 48 名本科生,43 名女生、5 名男生,年龄 19 到 24 岁,平均 21.69 岁,标准差 1.16,均为汉语母语、英语为二语,自报听力和视力正常或矫正正常,均签署知情同意并获得报酬。性别不平衡是原文直接报告的事实,复现时应如实记录并讨论可能的推广限制,而不是自行假设性别无影响。

流程一致性体现在设备、指导语和试次结构。实验在安静的计算机教室进行,要求仔细听并尽快判断,同时充分考虑所有可用信息。每个试次先呈现语境声音加文字,再经过间隔呈现无文字的目标句声音,然后按键作答。三分之一试次后附加语境理解题,这是注意力控制,不是主因变量。练习 9 个试次用于熟悉流程,正式 54 个试次保证每个条件 6 个观测。

统计聚合对象需要对齐:反语判断比例按条件聚合,反应时在水平主效应不显著后排除了水平因素再分析语境与韵律。随机效应同时纳入被试和句子,意味着结论试图同时推广到新被试和新句子。复现时若改用方差分析而忽略句子随机效应,显著性可能虚高,应尽量保留原文的混合模型结构。

指标方向与公平比较:数字变大代表什么?

反语判断比例越大表示越倾向于反语解读,反应时越小表示加工越顺畅或线索越一致。比较的公平条件是同一目标句在不同语境和韵律下轮换出现,语境音频的嗓音和韵律恒定,目标句响度归一化,判断键位和指导语全程不变。只有在这些条件一致时,才能把比例差异归因于语境不一致或韵律类别。

论文特有的细节有两类值得展开。第一,语境文字只在语境阶段呈现,目标句阶段不呈现文字,这迫使被试依赖听觉韵律而不是阅读重音。第二,材料经过风格化和筛选,强不一致与无不一致是清晰对比,模糊是中性上下文,这种设计放大了语境梯度但牺牲了日常对话的自然度,解读时不能把实验室比例直接当成自然频率。

另一类细节是字母标记的含义。柱状图顶端的紧凑字母显示不是效应量,而是两两比较的显著性分组。初学者常见误解是把误差线不重叠直接当成显著,应以论文报告的模型估计和事后检验为准,误差线只用于直观观察变异范围。

主结果:语境梯度与韵律梯度各有多大?

先看总体主效应要回答的问题是:在平均掉其他因素后,语境和韵律是否各自系统改变反语判断。公平条件是同一混合模型同时纳入语境、韵律和水平,随机效应控制被试和句子差异。指标方向是反语判断比例越高越倾向反语。结果报告显示语境和韵律主效应均显著,水平主效应不显著。

关键数字是语境平均下强不一致为 83.80%,模糊为 38.33%,无不一致为 22.80%;韵律平均下反语韵律为 66.32%,中性为 47.57%,真诚为 31.37%。这支持语境是更基础的线索,同时韵律也有系统作用。限制是平均数掩盖了交互,真正重要的是在不同语境下韵律的作用是否一样大。

下表把总体梯度整理为可核对的形式,条件、指标、分组与原文一致,数值保留原文精度。表前已说明比较问题、公平条件和指标方向,表后将解释交互如何修正总体结论,并指出水平未胜出的边界。

条件维度指标强不一致或反语韵律中间条件无不一致或真诚韵律
语境平均反语判断比例83.80%38.33%22.80%
韵律平均反语判断比例66.32%47.57%31.37%

表后解释需要增加新信息:总体上语境梯度大于韵律梯度,强不一致与无不一致相差约 60 个百分点,而反语韵律与真诚韵律相差约 35 个百分点。但这只是平均效应,模糊语境下的韵律差异远大于平均差异,说明用总体数字代替条件数字会低估韵律在模糊时的价值。未胜出项是水平因素,其主效应卡方很小且不显著,不能用水平高低解释总体选择偏向。

反语判断比例 × 反应时: 反语判断比例指在二选一任务中按批评和否定作答的次数占比,反应时指从目标句播放后到按键的时间;二者搭配的理由是前者反映最终选择偏向,后者反映加工难度和线索一致性,组合意义在于区分看似相同的低反语率是顺利理解为真诚还是困难中猜测。

下面两张图分别从语境视角和韵律视角展示高低组的判断比例。在阅读具体柱子之前,先确认纵轴是预测的反语判断百分比,面板切分的是另一因素,柱顶字母是显著性分组,误差线是 95% 置信区间。

导读:下图按高水平组和低水平组分面板,比较 3 种语境下的反语判断比例,重点看语境梯度是否在两组都成立,以及高组是否在强不一致下更高。

看图路径: 1. 先看左右两个面板分别对应高水平组和低水平组;2. 再比较每个面板内强不一致、模糊、无不一致三根柱子的高度顺序;3. 注意柱顶字母标记 c、b、a 表示组内条件是否显著分离;4. 观察高低组在强不一致条件下的置信区间宽窄差异

原论文 Figure 1:The bar plot (with 95% CI) of the proportions of ironic response in three context conditions and…

论文图 3。原论文 Figure 1:“The bar plot (with 95% CI) of the proportions of ironic response in three context conditions and two levels (averaged across all”。

解释:可见内容显示两组都呈现强不一致最高、模糊居中、无不一致最低的梯度,柱顶字母从 c 到 b 再到 a 逐级分离。高水平组在强不一致下接近顶部且置信区间更窄,低水平组在同一条件下略低且区间更宽,这与正文报告的高组 93.9% 和低组 83.9% 的局部差异一致。但模糊与无不一致的组间差异并不突出,说明水平优势不是全局性的。

导读:下图按反语、中性、真诚韵律分面板,比较高低两组的反语判断比例,重点看组间差异是否只出现在反语韵律下。

看图路径: 1. 先看三个面板分别对应反语、中性、真诚韵律;2. 再比较每个面板内高水平与低水平两根柱子的高度;3. 注意反语韵律面板中高组高于低组而另两面板差异很小;4. 观察柱顶字母 c、b、a 如何跨韵律形成梯度

原论文 Figure 2:The bar plot (with 95% CI) of the proportions of ironic response in three prosody conditions and…

论文图 1。原论文 Figure 2:“The bar plot (with 95% CI) of the proportions of ironic response in three prosody conditions and two levels (averaged across all context”。

解释:可见内容显示反语韵律面板的两根柱子最高且高组高于低组,中性面板两组接近,真诚面板两组都最低且接近。柱顶字母在反语面板为 c、中性为 b、真诚为 a,表明韵律梯度清晰。这支持正文的判断:水平与韵律的交互显著,但水平差异只在反语韵律下显著,中性和真诚韵律下不显著,因此不能说高水平者全面更敏感。

交互与反应时:韵律何时补位、何时被覆盖?

交互要回答的是反证问题:如果语境很强,韵律是否还重要;如果语境模糊,韵律是否成为决定性线索。公平条件是同一 3×3 设计下的两两比较,指标仍是反语判断比例。论文报告语境与韵律交互显著。模糊语境下反语韵律为 75.47%,中性为 29.46%,真诚为 10.97%,梯度极大。

强不一致下三者为 96.64%、90.98%、79.12%,整体很高;无不一致下三者为 36.41%、16.57%、5.77%,整体很低。正文还报告在反语韵律下语境对比被削弱,说明韵律可以部分抬高模糊和无不一致条件的反语率。

下表把 3×3 交互整理为可核对的形式,行列与原文表 1 一致,数值保留原文精度。表前已说明比较问题是韵律效应是否随语境变化,公平条件是同一批目标句轮换组合,指标方向是比例越高越倾向反语。

语境条件韵律条件反语韵律反语率中性韵律反语率真诚韵律反语率
强不一致3 种韵律对比96.64%90.98%79.12%
模糊3 种韵律对比75.47%29.46%10.97%
无不一致3 种韵律对比36.41%16.57%5.77%

表后解释要讲代价与反例:韵律的收益集中在模糊语境,从真诚到反语相差约 64 个百分点;在强不一致下即使真诚韵律也有约八成反语判断,在无不一致下即使反语韵律也只有约三成反语判断,说明语境充分时韵律只能增强或减弱而不能翻转结论。这正是论文所说的次级线索含义。未评测边界是字面批评的反语恭维,论文明确留作未来工作。

反应时提供另一条证据。语境与韵律主效应及交互均显著:在无不一致下真诚韵律最快,在强不一致下反语韵律最快,在模糊下真诚韵律最快而中性最慢。这表明一致组合加工更快,模糊加中性最困难。不能把反应时快慢直接等同于正确率,模糊下真诚韵律快可能是迅速走向真诚解读,而不是更准确。

导读:下图按 3 种语境分面板,比较 3 种韵律下的预测反应时,重点看每个面板内哪个韵律最快以及中性韵律何时最慢。

看图路径: 1. 先看三个面板分别对应强不一致、模糊、无不一致语境;2. 再比较每个面板内反语、中性、真诚三根柱子的反应时高低;3. 注意字母 a 的柱子是该面板下最快的条件;4. 观察模糊语境下中性韵律柱子最高且误差线较长

原论文 Figure 3:The bar plot (with 95% CI) of the RT in three context conditions and three prosody conditions.

论文图 2。原论文 Figure 3:“The bar plot (with 95% CI) of the RT in three context conditions and three prosody conditions.”。

解释:可见内容显示左面板强不一致下反语柱最矮并标为 a,中性与真诚更高并标为 b;中面板模糊下真诚柱最矮标为 a,反语与中性更高标为 b,且中性柱最高;右面板无不一致下真诚柱最矮标为 a,反语与中性更高标为 b。纵轴单位是秒,误差线为 95% 置信区间。这支持线索一致则快的解释,也显示模糊语境下中性韵律缺乏指向性因而最慢。

哪些结论要收着读:设计与证据的边界在哪里?

第一,语境主导的结论依赖风格化材料。论文明确说上下文为了保证实验对比而风格化,不是完全复刻日常对话,因此实验室中强不一致接近九成的反语率不能直接当成自然对话频率。复现若改用更自然的对话,语境梯度可能变小,韵律的作用可能相对上升。

第二,韵律证据来自单一说话人和有限验证。目标句只有 1 名女性母语者录制,验证只有 4 人评分,推广到其他嗓音时需谨慎。论文未报告可重用的声学阈值,也未公开代码、模型或数据,资源状态为没有发现可验证的公开资源,因此不能声称材料或代码已公开。

第三,水平效应的表述要区分直接报告与有限解释。直接报告是水平主效应不显著、3 阶交互不显著;有限解释是水平与语境、水平与韵律的 2 阶交互显著但差异只出现在强不一致和反语韵律等显著条件下。可能但待验证的是水平差异只在反语特别显著时才显现,这需要更大样本或连续分数建模来确认,不能当成因果结论。

复现先做什么:可重放的最小步骤是什么?

先对齐被试与分组:招募汉语母语的英语学习者,记录年龄与性别分布,用相同规则的 C-测试计分并保留连续分数,再按平均分分组并报告高低组均值与标准差。不要只保留分组标签,因为阈值依赖样本均值,跨样本比较时需要原始分数。

再重建材料:编写字面表扬的目标句并固定句式,撰写强不一致、模糊、无不一致 3 类语境,用固定嗓音合成语境音频并统一为 44.1 kHz、16 bit WAV;请母语者先录中性再录反语和真诚,响度归一化到 70 dB,再找独立听者做 5 点量表筛选。只有走完筛选,才能声称韵律条件有效。

最后重放流程与分析:用相同试次结构呈现语境加文字、间隔、目标句无文字、按键判断,保留练习和注意力检查;用混合模型同时纳入语境、韵律和水平并加入被试和句子随机效应,显著交互后做 Tukey-HSD 比较并用紧凑字母显示呈现。还需补的验证包括男性或多说话人、自然对话语境、反语恭维材料,以及眼动或脑成像等在线指标,才能检验结论是否超出当前行为数据。

何时值得尝试这个结论:给教学与研究的收束判断?

当教学目标是提高英语反语听辨时,值得优先训练语境不一致的识别,例如先找事实与字面评价的冲突点,再听语气做确认。当语境本身模糊或信息不足时,再重点利用韵律线索,因为此时韵律的增量最大。当学习者水平不同时,不必把水平当成首要分组依据,论文显示水平主效应很小,分组差异只出现在局部显著条件。

对研究而言,该结果支持平行约束满足模型的并行加权解释:多种线索同时累积,语境权重更大,韵律在不确定时权重上升。这与关联理论强调的心理状态归因也相容,因为模糊加中性时反应时最长,说明需要更多推理努力。但这只是行为数据的支持,不是神经机制的证明。

常见的误解是把韵律显著当成韵律充分。原文的反例很清楚:强不一致下真诚韵律仍多被判为反语,无不一致下反语韵律仍多被判为真诚。因此复述时应说语境主导、韵律补位、水平作用小,并保留适用条件为字面表扬、单一女声、实验室风格化语境和中国英语学习者样本。

⚖️ 评分明细

评分属于系统判断,不是论文实验结果;八维数值与总分见页首,原始审计记录保留在后端。

  • 评分规则:type-aware-v1
  • 评分模型:muse-spark-1.3-contributor
  • 评分请求协议:openai_responses

← 返回 interspeech-2026 论文汇总