英文题目:Ironic Prosody Perception in Mandarin: The Role of Autistic Traits

会议身份:conference:speechprosody:2026:conference-paper-id:yu26_speechprosody

✅ 来源为官方会议 PDF;表格与 Figure 按原文证据绑定。PDF 公式以原页区域图片展示,未冒称作者原始 TeX。

会议来源:官方记录 · 官方 PDF

标签:#心理声学实验 #韵律 #言语感知 #语音 #口语理解

评分:5.5/10 | 创新 1.3/2 | 技术严谨 1.2/1.5 | 实验充分 1.0/1.5 | 清晰度 0.8/1 | 影响力 0.7/1.5 | 开源 0.0/1.5 | 可复现 0.3/0.5 | 工程/实践 0.2/1.5

排名:前50% | 文档类型:应用研究

👥 作者与机构

  • Aijing Yu:机构信息未能从会议 PDF 纯文本可靠映射
  • Yuhan Jiang:机构信息未能从会议 PDF 纯文本可靠映射
  • Lu Chen:机构信息未能从会议 PDF 纯文本可靠映射
  • Ting Wang:机构信息未能从会议 PDF 纯文本可靠映射

📌 核心摘要

本研究输入为剥离上下文的普通话孤立句音频,输出为字面与反语的二分类判断,难点在于声调语言中词汇声调约束下韵律线索能否独立消解语义极性与说话人立场的冲突。首先通过语境诱导录制目标句并从对话中切除上下文以生成纯韵律刺激,其输出经振幅归一化后进入受控句式构建环节。接着采用固定句式你真是个体贴的朋友类模板并经情感词表校验以分离语义类型与韵律类型,其形成的四条件刺激集进入在线听辨任务。然后在个人设备上随机呈现刺激并收集字面或反语判断,其判断结果进入重复测量方差分析与孤独症谱系商数相关检验。与既有临床分组二分比较不同,该工作将孤独症特质视为连续维度并聚焦无语境韵律条件,揭示了韵律有效性依赖冲突方向的非对称机制。在无语境听辨任务条件下,反语批评的准确率为.84,高于反语表扬的准确率.25。结论的适用边界受限于单发音人短句与实验室听辨情境,尚未验证多轮对话多说话人与多模态线索下的外推,原文未披露训练、推理或部署成本。

🔗 开源与复现资源

🧭 深度解读

输入是什么,目标是什么,读完要能复述什么?

本文解读的输入是 Speech Prosody 2026 的 1 篇会议论文,主题是普通话反语韵律感知与自闭特质的关系。目标读者是刚进入语音与语言加工的研究生,读完要能复述任务设计、刺激构造、实验流程和主要数字结论,而不是记住一般性反语理论。必须保留的信息包括 4 类句子条件、语境诱导录音与切分做法、在线听辨判断、无语境呈现、20 名被试与自闭商数量表、声学验证方向、正确率不对称格局以及只在反语表扬上显著的负相关。

输出按学习依赖展开,先讲为何只听声音判反语是一个真问题,再讲相关路线如何争论韵律的作用,然后走完一个样本从输入到判断的全过程,最后讲实验条件、结果边界与复现要点。

反语是说话人字面说的话与真实意图不一致,听者必须推断意图才能听懂。白话说就是嘴上夸心里贬,或者嘴上贬心里夸。自闭特质(autistic traits)指普通人群中连续分布的社交沟通与注意转换等倾向,用自闭商数量表(Autism-Spectrum Quotient,简称 AQ)度量,得分越高表示越接近自闭谱系方向的特质倾向,但不等于临床诊断。心智理论(Theory of Mind,简称 ToM)指推测他人信念与意图的能力,执行功能指抑制字面意义、切换解释的控制能力。论文把这两类认知需求与韵律线索放在一起,问的是当没有上下文、只能靠声音时,不同方向的反语是否一样好听懂,以及自闭特质高的人是否在最难的条件下掉得更多。

自闭特质 × 心智理论: 自闭特质指在未达临床诊断的普通人群中连续分布的社交沟通与刻板倾向,用自闭商数量表度量,负责刻画个体差异;心智理论指推测说话人真实意图和信念的能力,负责解释为何能从字面跳到意图。两者搭配的理由是高自闭特质常伴随心智理论和执行功能调用困难,组合后可以检验在韵律与语义冲突最大、最需要抑制字面意义的反语表扬条件下,个体差异是否被放大。

对于初学者,关键误解是把听懂反语等同于听懂字词。字词听懂只解决语义类型,而反语还要解决说话人立场。普通话又是声调语言,每个音节自带音高走势,韵律的整体抬高压低容易与字调纠缠。因此论文选择固定句式、单一说话人、振幅归一化,就是要把词汇和响度差异压住,只留下可控的韵律姿态差异,再看听者能否靠这一点点声音扭转字面判断。

补充:核心术语如何固定使用?

为保证复述一致,全文术语固定如下。语义类型只指字词内容的褒贬,不指声音。韵律类型只指声音姿态的积极或消极,是感知描述。反语表扬只指坏话包装的好意,反语批评只指好话包装的讽刺。字面条件只指两者方向一致,反语条件只指两者错位。

自闭特质只指连续分布的倾向得分,不指诊断。基频只指平均振动频率,时长只指整句持续时间,强度只指响度,实验中强度已被归一化。正确率只指二选一判断中判对的比例,越高越好。交互显著只指语义效应随韵律变化,不能读成两个主效应简单相加。

前人把韵律放在什么位置,为何还有争论?

同输入同目标的一条路线认为韵律本身就能提示非字面意义。论文回顾说反语常伴随语速放慢、平均基频降低或明显下降、强度降低,这类突出被看作提醒听者注意非字面意义的信号。支持证据包括多语言中无语境只靠韵律也能显著高于随机猜测,以及儿童 5 岁就能靠语调理解反语,而靠语境要到 7 岁左右,强调语调还能提高儿童的理解正确率。这条路线把韵律当作独立可用的线索。

另一条同任务路线认为韵律的作用受语境制约。当语境不一致足够强时,听者主要靠语境判反语,韵律只在语境不足时起辅助作用。论文引用了这类观点,说明只给声音而不给语境,恰好是检验韵律上限的苛刻条件。如果这种条件下还能听出某类反语,说明该类韵律映射比较稳固;如果听不出,也不能直接说日常听不懂,因为日常还有语境帮忙。

同目标不同人群的路线集中在自闭谱系障碍儿童,报告他们在反语等非字面语言上有困难,机制解释指向利用语境推断意图、心智理论、语用与情绪加工的困难。但前人多用临床组与健康对照的 2 分比较,忽略了普通人群中自闭特质的连续分布。中国大学生中高自闭特质比例可达 6.4%,这群人处理复杂语用信息时可能有不同程度的困难。论文的切入点就是把连续特质维度与无语境韵律任务结合,并放在声调语言普通话中检验,这是已有文献较少系统覆盖的位置。

补充:与同类工作如何公平对照?

公平对照要按同输入、同目标、同监督和同运行阶段划分。同输入同目标的是无语境韵律判反语的多语言研究,对照点是是否高于随机、哪类反语更容易,不能把有语境的研究直接当基线比高低。同目标不同输入的是加语境或多模态的研究,对照点是语境强度如何改变韵律权重,而不是谁的正确率绝对更高。同目标不同人群的是自闭谱系儿童研究,对照点是机制解释中心智理论与语境利用的位置,不能把儿童临床困难直接等同于成人连续特质的梯度关联。声调语言与非声调语言的对照要说明字调干扰的存在,不能把类别差异当同条件胜负。

要解决的具体问题与预期是什么?

论文要回答两个可操作的问题。第一,在没有任何前文语境、只听孤立句子的条件下,普通话听者能否仅凭韵律区分字面与反语,以及反语表扬与反语批评是否一样好区分。第二,自闭特质得分是否预测听辨正确率,特别是在最难的条件下是否出现关联。假设是自闭特质越高,反语感知越差。

任务被定义为二选一听辨判断。每次呈现一个孤立录音,被试判断它是字面还是反语。4 个条件来自语义类型与韵律类型的交叉。语义类型(semantic type)指句子内容的评价是表扬还是批评,韵律类型(prosodic type)指声音听起来的情感姿态是积极还是消极。论文强调积极与消极韵律是感知描述,不是固定声学类别。当两者方向一致就是字面,当两者错位就是反语。

字面一致 × 语用错位: 字面一致指语义评价与韵律情感姿态方向相同,负责构成字面表扬和字面批评的基线条件;语用错位指语义与韵律方向相反,负责构成两类反语的试验条件。两者搭配的理由是只有先确认一致条件下接近天花板,才能把错位条件下的下降归因于韵律消解冲突的难度,而不是听不清或不会做任务。

教学上可以这样记。字面表扬是好话配好语气,字面批评是坏话配坏语气。反语批评是好话配坏语气,真实意图是贬。反语表扬是坏话配好语气,真实意图是褒。前者日常更常见,常用来软化冒犯或制造幽默,听者可能已形成稳固的映射。

后者统计上更罕见,听者需要一边抑制显眼的否定字面,一边整合微妙的积极韵律,认知负荷更大。论文正是要看这种不对称在普通话无语境条件下是否出现。

补充:任务的操作定义与判断标准?

操作定义上,输入是孤立录音,输出是字面或反语的二选一标签,监督来自预设的语义与韵律组合,不来自听者主观报告。字面批评的标准是批评词加消极韵律,字面表扬的标准是表扬词加积极韵律,反语批评的标准是表扬词加消极韵律,反语表扬的标准是批评词加积极韵律。判断正确当且仅当听者标签与预设组合一致。教学例子明确标为例子,例如把你真是个体贴的朋友用讽刺语气说出只是帮助理解模板,不代表原刺激只有这一句,也不附带任何效果数值。所有效果数值只以结果表中的 4 个均值和统计量为准。

方法全景:一个句子如何走完录音到判断?

先沿一个样本走完全程。取模板句你真是个体贴的朋友,语义类型是表扬。如果要做成字面表扬,女说话人先读一段积极语境,把自己带入真心夸人的状态,然后自然说出目标句。如果要做成反语批评,同一串字用消极的讽刺姿态说出,录音后再把目标句从前后语境中手动切出来,单独呈现。听者听到的就是这段孤立音频,没有前文。

他要回答这是字面还是反语。系统记录正确率,事后按条件平均,并与自闭商数得分做相关。

刺激集共 20 句,4 类条件各 5 句。句式统一为你真是一个加形容词加名词的结构,例如你真是个体贴的朋友。形容词的情感内容经过中文情感词库核对,并请未参与实验的母语者评估,以保证褒贬方向有效。录音由 1 名女性普通话母语者在隔音室完成,采用语境诱导法保证韵律自然。录音用 Praat 保存为 16 比特脉冲编码调制波形文件,采样率 44100 赫兹。

实验前做振幅归一化,控制响度差异。声学上自然改变基频、强度和时长来形成不同解读,并做声学分析验证。

基频 × 时长: 基频指声音的平均振动频率,听感上接近音高高低,负责标记反语中压低或下滑的语调;时长指整句发音持续时间,负责标记反语中放慢的语速。两者搭配的原因是普通话有声调,单靠局部音高易与字调混淆,需要全局的平均基频下降加整体拉长共同构成可感知的非字面提示,本研究用二者验证录音确实产生了预期的韵律对比。

当前可用性需要按资源状态如实说明。论文参考文献中给出 Praat 官网链接,本次核对状态为可用,可以写当前可用。Credamo 在线问卷平台链接本次核对状态也为可用,可以写当前可用。这两个只是工具与平台链接,不代表本研究的刺激音频或代码已公开。论文本身没有声明公开数据与代码,因此不能写数据已公开或可下载。

组件分工:语义、韵律、被试筛选各管什么?

语义组件管字面方向。固定模板把句法和长度压住,形容词核对把褒贬压住,这样 4 类句子的字面差异只剩表扬词与批评词的区别。韵律组件管立场姿态。说话人通过语境诱导产生积极或消极的整体发声方式,体现在平均基频、时长和强度上。振幅归一化后强度不再是混淆因素,时长拉长和平均基频降低成为反语的主要标记。论文报告反语刺激比字面刺激时长更长、平均基频更低,强度因归一化而接近,这与既往文献方向一致,说明预期的韵律对比确实被制造出来。

语义类型 × 韵律类型: 语义类型指句子字面内容的评价方向,是表扬词还是批评词,负责提供字面命题;韵律类型指说话人用声音传达的情感姿态,是积极还是消极语调,负责提示真实立场。两者搭配的理由是反语的本质就是二者错位,字面说好话而语调消极即反语批评,字面说坏话而语调积极即反语表扬,组合后才能在无语境条件下单独检验听者是否靠声音纠正字面意义。

被试筛选组件管基线能力。正式实验前有 5 个简短对话的前测,要求正确率至少 80% 才能进入正式实验,保证纳入者具备最低限度的反语理解基线。这样正式任务中反语表扬的低分就更可能来自韵律消解冲突的困难,而不是完全不懂什么是反语。正式实验在线上完成,被试在安静环境用个人电脑或手机听音,每次一题,顺序随机,要求判断字面还是反语。

反语表扬 × 反语批评: 反语表扬指用否定字面表达肯定意图,例如用消极语句夸人,负责制造语义为负而意图为正的冲突;反语批评指用肯定字面表达否定意图,例如用夸奖语调讽刺,负责制造语义为正而意图为负的冲突。两者搭配的原因是它们方向相反但都依赖韵律消解冲突,组合比较能揭示韵律线索是否对称有效,本研究发现前者极难而后者较易,说明冲突方向改变了加工难度。

个体差异组件管连续特质。自闭商数量表共 50 题,覆盖社交技能、注意转换、注意细节、沟通和想象 5 个维度,每维度 10 题。采用从非常同意到非常不同意的迫选作答,按标准计分把符合自闭方向的回答记 1 分,总分 0 到 50 分,得分越高特质越强。论文明确把它当作神经典型群体中的粗粒度维度测量,不是诊断工具,结论只能解释为连续个体差异,不能解释为类别区分。

本研究训练了什么,没有训练什么?

本研究没有训练任何神经网络模型,也没有优化器、梯度路径、参数冻结与更新、早停或权重重置需要报告。这是一个人类行为实验,真实计算发生在刺激构造、声学验证和统计分析 3 个环节,不能把无训练等同于确定性求解,人类判断本身就有变异。

刺激构造的计算是录音、切分与归一化。语境诱导后朗读,手动切出目标句,振幅归一化消除响度混淆。声学验证的计算是对每类句子求基频、时长和强度的均值与标准差,确认反语更长、平均基频更低。统计分析用 R 完成,先按被试和条件算平均正确率,再做 2 乘 2 重复测量方差分析,因素是语义类型与韵律类型,最后对自闭商数与各条件正确率做皮尔逊相关。缺项需要明确指出。论文未报告试次级原始数据分布、随机效应建模、功效分析细节、反应时、设备与耳机校准、在线环境噪声控制的具体阈值,这些缺失不是技术错误,但在复现时需要补记。

实验条件:被试、材料、流程如何对齐?

被试是 20 名普通话母语大学生,无报告的视觉、听觉或神经损伤史。年龄范围 19.4 到 26.2 岁,平均 22.9 岁,标准差 1.65 岁。自闭商数范围 11 到 36 分,平均 21.85 分,标准差 5.47 分。样本量较小,这是后文统计效力的直接限制。所有被试签署知情同意并获得报酬。

材料是 20 个目标句,每类 5 句。模板固定,形容词经中文情感词库与母语者核验。呈现时无前文语境,只有孤立句子。录音人为单一女性母语者,隔音室录制,Praat 保存,采样率 44100 赫兹,16 比特波形,振幅归一化。声学参数自然变化形成不同解读,强度因归一化而接近,时长与平均基频构成主要对比。

流程分两段。前测 5 个对话场景,要求 80% 以上正确才能进入正式实验。正式实验用 Credamo 平台在线实施,被试在安静环境用自备设备完成,每次听一句并判断字面还是反语,顺序随机。指标是判断正确率,方向是越高越好。聚合方式是先按被试在每类条件下平均,再做组平均与标准误。

统计用重复测量方差分析看主效应与交互,再做简单效应分解,最后做自闭商数与正确率的相关。硬件预算与推理开销不适用,因为没有模型推理,只有人工听音与离线统计。

主结果:哪些条件好判,哪些条件崩了?

要回答的核心比较是 4 类条件在相同无语境、相同判断任务下的正确率。公平条件是同一批被试、同一模板、同一说话人、同样经过归一化,指标方向都是正确率越高越好。下表把 4 个条件放在同一口径下比较,表中数字来自原文连续报告,单位都是正确率均值。

条件语义方向韵律姿态平均正确率可运行判断
字面批评批评词消极0.99接近天花板
字面表扬表扬词积极0.98接近天花板
反语批评表扬词消极0.84相对较高
反语表扬批评词积极0.25明显困难

表前已提出比较问题与公平条件,表后需要解释收益与代价。字面条件接近天花板说明任务本身可做,听者能听清并理解基线。反语批评 0.84 说明即使没有语境,强标记的消极韵律仍能把听者从肯定字面拉向否定意图。反语表扬 0.25 说明积极韵律不足以把听者从否定字面拉向肯定意图,多数判断被字面牵引。未胜出项就是反语表扬,它是明确的负结果,也是后文个体差异分析的焦点。

下面先看 4 条件均值图的整体落差,再看自闭特质相关的散点图。第一张图只解决条件不对称,第二张图只解决个体差异方向,不互相替代。

以下段落为第一张结果图的导读,说明横轴条件与纵轴正确率的对应关系,以及需要重点比较的落差位置。图中 4 个位置分别对应字面批评、字面表扬、反语批评和反语表扬,纵轴为平均正确率,误差线为标准误,预期前两者贴顶,第三者次高,第四者显著下坠。

看图路径: 1. 先确认横轴四个条件从字面批评到反语表扬的排列顺序;2. 再比较前三个柱高与最后一个柱高的落差幅度;3. 最后查看误差线长短,判断字面条件是否接近天花板且变异很小

原论文 Figure 2:Mean accuracy rates under 4 sentence conditions. Error bars represent standard errors (SE).

论文图 2。原论文 Figure 2:“Mean accuracy rates under 4 sentence conditions. Error bars represent standard errors (SE).”。

上图显示的模式与数字表一致。字面两柱高且误差线短,说明接近天花板且个体变异小。反语批评柱明显低于字面但仍处高位,反语表扬柱则大幅下坠,这是全文最关键的不对称。教学上不要把曲线向下直接读成设备问题,这里是条件难度差异。像素较模糊时不要硬读具体小数,精确均值以正文报告的 0.99、0.98、0.84 和 0.25 为准。

机制分解:方差分析与相关各支持什么?

方差分析解决的是语义与韵律是否独立起作用。结果显示语义类型主效应显著,字面高于反语。韵律类型主效应显著,说明韵律影响判断正确率。关键是两者交互显著,说明语义对正确率的影响被韵律调节。简单效应进一步显示,在否定语义下韵律效应显著,表扬韵律与批评韵律差异大。

在肯定语义下韵律无显著效应。当韵律为积极时语义极显著,当韵律为消极时语义仍显著但差异幅度变小。合起来就是反语表扬独特地难,反语批评相对好检出。下表把统计量放在同一框架下,便于核对自由度、显著性与效应量。

分析对象统计量显著性效应方向适用条件
语义主效应F(1,19)=81.02p<0.001字面高于反语重复测量
韵律主效应F(1,19)=63.33p<0.001影响判断正确率重复测量
语义×韵律交互F(1,19)=59.40p<0.001语义效应被韵律调节重复测量
自闭商数与反语表扬相关r=-0.481p=0.032得分越高正确率越低仅反语表扬

表后解释需要区分报告与推测。论文报告的是交互显著和单条件负相关,支持的是韵律线索的效用依赖冲突方向,以及个体差异在最难条件下可观察。未胜出项是其余 3 条件的相关都不显著,说明自闭特质不是全面拉低听辨,而是有边界。论文对机制的解释是谨慎的推测,认为反语表扬有双重需求,既要整合微妙韵律又要抑制显眼否定字面,可能更依赖执行功能与 2 阶心智理论,但因只在 1 个条件下出现且语境极简,需要谨慎对待,不能读成因果。

以下段落为第二张图的导读,聚焦自闭商数与反语表扬正确率的散点与回归线。横轴为自闭商数得分,纵轴为反语表扬正确率,蓝色直线为回归线,浅蓝带为置信带,红色点为被试,需要看整体下行趋势而非单个点。

看图路径: 1. 先确认横轴为自闭商数得分,纵轴为反语表扬判断正确率;2. 再沿蓝色回归线看从左到右的下降趋势;3. 最后观察浅蓝色置信带宽度与右端高分被试的散点位置

原论文 Figure 1:Correlation between AQ scores and

论文图 1。原论文 Figure 1:“Correlation between AQ scores and”。

上图可见回归线从左到右向下,图内标注斜率约为负 0.03、截距约 0.91,决定系数约 0.23。左侧低分被试正确率相对较高,右侧高分被试多聚集在底部,右端还有高分低正确率的散点。浅蓝置信带在左侧较宽,说明小样本下估计不确定性大。结合正文报告的相关系数负 0.481 且显著,可以说趋势存在但离散明显,不能把每一步下降都当作必然,也不能推广到反语批评与字面条件。

边界在哪里,哪些结论不能推广?

样本边界最直接。20 人均为大学生,年龄跨度窄,自闭商数范围 11 到 36 分,统计效力可能不足以检出微弱效应。未来需要更大更多样样本,或直接比较高低分组的组间设计,并纳入执行功能与心智理论的独立测量,才能更完整地检验认知机制。

材料边界同样明确。刺激只有 20 句,语言多样性有限,句式固定为你真是一个加形容词加名词,结论是否推广到其他句式与语境需要更多样刺激验证。声学只做到句子级全局均值,抽象掉了音节级声调上的局部基频走势,而普通话的反语韵律恰好叠加在字调之上,未来需要更细的局部音高轮廓分析。说话人只有 1 名女性,自然变异被压住,未来需要多说话人捕捉韵律多样性。

条件边界是无语境。在线自备设备、安静环境的自我报告控制也弱于实验室。论文结论是韵律单独足以支撑反语批评但不足以支撑反语表扬,这只在无语境苛刻条件下成立。日常有语境、多模态和多轮对话时,反语表扬可能好得多。未测量反应时、延迟、误判类型和成本,因此不能承诺任何效率或部署收益。

要复现这项实验,先做什么?

先复现材料构造。按固定模板写 4 类句子,形容词用中文情感词库核对褒贬,再请未参与实验的母语者独立评估。为每句准备简短语境,诱导说话人进入积极或消极立场后读出目标句,隔音室用 Praat 录制,采样率 44100 赫兹,保存 16 比特波形,手动切出目标句并做振幅归一化。保留每类的平均基频、时长和强度均值与标准差,确认反语更长、平均基频更低、强度接近。

再复现流程与分析。先做 5 题对话前测,80% 正确线筛选。正式任务无语境单句呈现,顺序随机,被试二选一判断字面还是反语。在线实施要记录设备类型、耳机使用和环境噪声的自我报告,尽量统一。分析先按被试和条件算平均正确率,再做语义乘韵律的重复测量方差分析并分解简单效应,最后算自闭商数与各条件正确率的皮尔逊相关。核对数字时注意单位与聚合对象,正确率均值、F 值、r 值和 p 值不要混用,百分点差异不等于相对百分比变化。

工具可运行性按本次核对写。Praat 官网当前可用,Credamo 平台当前可用,可用于录音与在线问卷。但论文未声明刺激音频、问卷原始数据与分析代码公开,因此复现需要自己重录与重写,不能假设下载即用。R 用于统计,需要保留版本与随机化种子设置。

何时值得借鉴这篇论文的方法?

当你的问题是声调语言中韵律能否独立提示反语,且怀疑不同方向的冲突难度不同,这篇论文的交叉设计值得借鉴。语义与韵律正交、字面一致做基线、语用错位做试验、无语境做上限测试,这套逻辑可以直接搬到其他句式或方言。固定模板加情感词核对加语境诱导录音加振幅归一化,是一套可重放的控制流程。

当你的问题涉及个体差异,论文提醒不要只做临床与对照 2 分。自闭商数作为连续维度,可以在神经典型群体中检验最难条件下的梯度关联。但必须记住这里的关联只在反语表扬上显著,相关不是因果,缺失执行功能与心智理论的直接测量,只能说支持而不能说证明机制。还需要补的验证包括多说话人、大样本、局部音高分析、丰富语境与多模态线索,以及误判方向是把反语听成字面还是反之。只有补上这些,才能判断积极韵律在何种语境强度下足以翻转否定字面。

📐 原文公式与排版

以下展示论文原页中的数学表达区域,保留原始上下标、分式和符号排版。区域序号仅用于本文导航,不是论文公式编号。

另有 18 个候选区域因边界不明确或图片数量、尺寸限制未展开;请查看完整论文中的原始排版。

⚖️ 评分明细

评分属于系统判断,不是论文实验结果;八维数值与总分见页首,原始审计记录保留在后端。

  • 评分规则:type-aware-v1
  • 评分模型:muse-spark-1.3-contributor
  • 评分请求协议:openai_responses

← 返回 speechprosody-2026 论文汇总