英文题目:Rôle des entrées somatosensorielles et de la langue maternelle pour la perception du contraste de quantité vocalique japonais
会议身份:
conference:jep:2026:conference-paper-id:vallois26_jep
✅ 来源为官方会议 PDF;表格与 Figure 按原文证据绑定。PDF 公式以原页区域图片展示,未冒称作者原始 TeX。
标签:#心理声学实验 #言语感知 #语音 #音频分类
评分:4.9/10 | 创新 1.3/2 | 技术严谨 1.2/1.5 | 实验充分 0.7/1.5 | 清晰度 0.8/1 | 影响力 0.8/1.5 | 开源 0.0/1.5 | 可复现 0.1/0.5 | 工程/实践 0.0/1.5
排名:后50% | 文档类型:应用研究
👥 作者与机构
- Inès Vallois:机构信息未能从会议 PDF 纯文本可靠映射
- Takayuki Ito:机构信息未能从会议 PDF 纯文本可靠映射
📌 核心摘要
本研究处理听觉时长到音位类别映射的言语感知任务,输入为从叔叔到祖父渐变的听觉语音,输出为短长元音词项判别,实际难点在于日语以时长区分词义而法语缺乏数量对立,致使无该范畴听者的听觉线索模糊且范畴边界不稳定。方法链分三步推进,先合成元音时长等步变化的听觉连续体以提供可控时长输入,再在辨认试次中交替施加口面皮肤后向牵拉并使牵拉持续时间对齐长元音,从而注入发音方向一致的体感证据。接着将听觉与体感配对输入送入二选一辨认并拟合心理测量函数,由全刺激平均反应比例检验体感主效应并由控制条件斜率比较母语敏感性,上一步的连续体判断直接成为下一步统计建模的输入。相对聚焦共振峰等频谱线索的既有体感语音工作,该机制差异在于将体感整合从频谱推广到时间维度的数量对立,并以日法母语对比检验整合是否依赖后天音系表征。这种推广的实际意义在于揭示母语感觉运动表征对时长感知的塑造,为理解跨语言感知差异提供多感觉视角。在辨认任务条件下,原文未提供可核对的关键定量结果。结论适用边界受限于单个元音对立与实验室皮肤牵拉范式,尚未验证向辅音长短自然语速及其他母语的外推。原文未披露训练、推理或部署成本。
🔗 开源与复现资源
本次未形成可展示的已核验资源记录,开放状态尚未核实。 可达状态仅表示本次链接检查结果,不代表许可证、本文权重或运行复现已验证。
🧭 深度解读
输入是什么,目标是什么,本文要保留什么?
本文解读的对象是 1 篇法语会议论文,主题是体感信息是否参与元音时长感知,以及这种参与是否受母语限制。输入是论文正文提供的实验描述与统计结果,目标是让刚进入语音与听觉领域的学生能够复述出任务逻辑、刺激构造、体感操作、试次安排、指标计算与统计结论。必须保留的信息包括被试构成、10 级听觉连续体、皮肤拉伸的施加方式、对照条件的交替方式、熟悉试次的排除规则、平均比例比较与斜率比较两条分析线,以及方差分析和事后检验报告的具体数值。
对于初学者,先建立一个基本区分。语音感知研究通常关注频谱差异,例如元音的开口度与舌位造成的共振峰变化,而本文关注的是时长差异,也就是同一个元音拖得更长是否会被听成另一个词。在日语中,短元音与长元音可以区分词义,论文使用的例子是从短元音词到长元音词的连续变化;在法语中,论文明确指出不存在这种音位性时长对比。因此,同样一段时长变化,对两组母语者可能意味着完全不同的语言任务。
本文的输出将按学习依赖展开。先说明已有路线为何主要研究频谱而较少研究时长,再把研究问题拆成两个可检验的预测,然后沿着一个试次走完听觉输入到按键输出,再展开被试分组、条件交替与数据聚合方式,最后组织结果、限制与复现要点。阅读时请注意,凡是教学举例都会明确标为例子,不作为论文的发现;凡是论文直接报告的数字,都保留原文写法并说明其比较对象和适用条件。
已有路线研究了什么,为什么时长对比仍是缺口?
论文在开头回顾了已有发现:在说话的同时施加体感刺激,会引起听觉判断的变化。引用的工作包括气流触觉整合以及口面部运动与体感对语音感知的影响,其含义是语音的内部表征可能不是纯听觉的,而是多感觉的。换成白话,就是大脑记住一个语音类别时,可能同时记住了它听起来怎样和说它时面部与口腔感觉怎样。
这条路线此前主要处理频谱变化,例如辅音或元音音色的边界移动。做法通常是在播放处于类别边界的模糊声音时,同步拉伸或扰动与发音相关的皮肤与肌肉,从而观察分类是否发生偏移。如果偏移稳定出现,就支持体感参与了音位判断。论文指出,这套逻辑很少被用于语言学意义上的时长对比。时长对比与频谱对比不同,它不依赖共振峰形状,而依赖一段声音持续了多久,这就带来新的问题:体感系统是否也编码时间长度,以及这种编码是否同样进入音位表征。
论文还引用了法语元音时间与频谱信息感知以及多母语者对长短对比感知的文献,用来说明母语中是否存在时长对比会影响敏感性。也就是说,法国人并非听不见时长差异,而是其母语不需要用时长区分词义,因此在类别任务中可能表现得更不敏感。这为后文同时比较条件效应和组间斜率提供了依据:前者检验体感是否引起偏向,后者检验母语是否带来基础敏感性差异。
本文要回答的两个具体问题是什么?
本文把大问题拆成两个可操作的问题。第一,体感系统是否参与元音时长的感知。操作化的方法是诱发一个偏向:在播放语音的同时施加口面部皮肤拉伸,观察被试是否更倾向于报告长元音。如果有拉伸时报告长元音的比例系统性升高,就报告存在体感影响。第二,这种偏向是否被母语中的音位表征所调节。
操作化的方法是比较两组被试:以日语为母语且日常使用时长对比的人,以及无日语经验的法语母语者。如果偏向只在日语组出现,就支持该效应与母语中是否建立时长类别有关。
体感输入 × 音位表征: 体感输入指来自口面部皮肤拉伸等身体感觉通道的信号,分工是提供与发音动作相伴的非听觉时间与运动信息;音位表征指大脑内部对母语中能区分词义的声音类别的记忆,分工是决定听觉输入被归为哪一类;二者搭配的理由是若长短元音在内部是以听觉加体感联合编码的,体感信号就能在听觉模糊时推动分类,组合意义在于把体感效应是否出现变成检验母语表征是否为多感觉的指标。
理解这两个问题时要避免一个常见误解:体感显著并不等于体感主导听觉。论文的逻辑是增量式的,即在听觉信息保持不变的情况下,附加体感是否足以推动判断。同一个听觉刺激在有无拉伸两种条件下各呈现多次,比较的是同一批刺激的平均反应差异,而不是比较不同刺激之间的难度。因此,问题一回答的是有无偏向,问题二回答的是偏向是否依赖母语,两个问题分别对应条件主效应与组间调节,不能互相替代。
从一次按键到全实验:方法全景如何串起来?
先沿着一个试次走完流程。被试听到一个语音刺激,它来自一条 10 级连续体,一端更像短元音词,另一端更像长元音词,中间各级仅改变元音的持续时间。被试的任务是二选一,判断听到的是短元音版本还是长元音版本。在体感条件下,播放的同时对口面部皮肤施加向后的拉伸,其持续时间对应长元音的时长;在对照条件下,则没有这种拉伸。1 次试次的输出就是一个二值判断,累积多次后可以计算每个刺激或全部刺激上报告长元音的比例。
音长对比 × 心理测量函数: 音长对比指日语中仅靠元音持续时间区分词义的对立,分工是提供从短到长连续变化的物理维度;心理测量函数指报告长元音比例随刺激序号变化的拟合曲线,分工是把离散的按键反应转化为可比较的阈限与斜率;二者搭配的理由是只有把等步长的时长 continuum 与二选一判断结合,才能同时观察整体偏向和平滑程度,组合意义在于区分体感是移动了类别边界还是改变了敏感性。
再把试次放大到全实验。每名被试共完成 800 个试次,两种条件每 10 个试次交替 1 次,且交替顺序经过伪随机化。前 160 个试次被视为熟悉阶段,不进入分析,目的是减少初期不稳定与学习过程对估计的污染。正式分析使用熟悉阶段之后的试次,计算报告长元音的平均比例,并在两种条件下相减得到体感引起的偏向量。另一条分析线是在对照条件下拟合心理测量函数,用斜率表示敏感性,再比较两组母语者的斜率差异。这样,偏向与敏感性两条线分别回答体感效应与母语基础差异,互不混淆。
听觉连续体是如何构造的?
听觉部分的核心是 10 级等步长连续体。起点与终点分别对应短元音词与长元音词,论文用法语词义注释为叔叔与祖父,以帮助非法语读者理解这是 1 对最小对立。构造时只改变元音的持续时间,保持其他声学属性尽量一致,并按相等步长生成中间刺激。这种构造的优点是物理维单一,解释链条清晰:若判断变化随刺激序号单调上升,就可以把横轴理解为时长增加,把纵轴理解为长元音反应增多。
对初学者可以举一个教学例子,例子:假设 10 级刺激按时长从短到长编号为 1 级到 10 级,1 级几乎总被判为短元音,10 级几乎总被判为长元音,中间级别出现过渡,这条过渡曲线的陡峭程度就是敏感性,整条曲线上下移动就是偏向。这个例子只是帮助理解曲线含义,论文并未报告每 1 级的具体时长毫秒数与具体比例,因此不能把例子中的数字当作论文数据。
口面部皮肤拉伸 × 听觉刺激: 口面部皮肤拉伸分工是提供与长元音发音方向一致的体感时间窗,其持续时间对应长元音的时长;听觉刺激分工是提供从短到长 10 级变化的语音信号;二者搭配的理由是让体感时长线索与听觉时长线索在同一试次中共现,组合新增作用是检验当听觉处于边界模糊时,体感时长是否被当作支持长元音的额外证据。
需要明确保留的细节是,被试的反应标签是短元音词与长元音词两种拼写形式,任务是辨别词而不是评价时长本身。这意味着被试动用的是语言类别知识,而非法语组恰好缺乏对应的类别,这正是后文组间比较的理论起点。
体感刺激与条件交替具体做了什么?
体感操作是对口面部皮肤施加向后拉伸。论文说明拉伸持续时间对应长元音中的元音时长,因此它不仅是一个触觉提醒,而是一个与目标类别在时间上相容的线索。选择向后方向与口面部位置,与发音时长相关的面部运动表征有关,但论文正文没有提供拉伸幅度、速度曲线或设备型号等更细的物理参数,复现时只能按方向、位置与时长对应这 3 个已报告要素执行,并在缺项中明确记录。
条件安排采用每 10 个试次交替 1 次有无体感,并做伪随机化。这种短块交替兼顾了两方面:一方面让两种条件在整个实验中分布均衡,减少疲劳与时间漂移只污染某一种条件;另一方面避免长时间连续同种条件使被试形成策略性期待。伪随机化意味着顺序不是完全随机,而是在满足均衡约束下的随机,复现时应保留块长度为十与顺序平衡的原则,而不是改为完全逐试次随机或半程切换。
类别判断 × 敏感性: 类别判断指每试次回答听到的是短元音词还是长元音词,分工是反映在当前条件下被试更倾向哪一类;敏感性指心理测量函数斜率所代表的随物理时长变化而改变判断的陡峭程度,分工是反映区分能力本身;二者搭配的理由是体感可能只改变偏向而不改变区分能力,组合意义在于用平均比例变化与斜率差异分别回答偏向问题和能力问题,避免把更爱选长元音误读为听得更准。
数据处理上,前一百六十试次整体剔除,不分条件单独剔除。剩余试次用于计算报告长元音的比例,并在被试内比较两种条件的平均值。这种被试内比较控制了个体反应偏好,因为每个人都同时提供有拉伸与无拉伸的数据,差异更可能来自条件本身而非个体差异。
本研究训练了什么模型?没有训练时如何理解计算?
本研究没有训练神经网络,也没有更新任何模型权重,因此不存在优化器、学习率、梯度路径、冻结层或早停等训练要素。把无训练理解为确定性求解是错误的,无训练只意味着没有拟合参数的过程,被试反应本身仍有随机性,统计推断仍需考虑个体差异与抽样误差。
本研究实际执行的计算是心理物理学中的常规聚合与推断。第一步是对每个被试分别统计两种条件下报告长元音的次数除以有效试次数,得到条件平均比例,再相减得到个体偏向量。第二步是在组水平用方差分析检验条件主效应,用配对思路的事后检验分别看两组内条件差异是否显著。第三步是在对照条件下拟合心理测量函数并提取斜率,用组间检验比较敏感性。拟合的具体函数形式与初值设置在正文证据中未报告,这是具体的缺项,复现时需要明确记录所选函数并说明与原文可能不一致。
从可复述的角度,关键是区分参数拟合与统计检验。心理测量函数拟合是对个体反应曲线的描述性建模,目的是得到斜率这个派生指标;方差分析与检验是对这些指标的推断,目的是判断差异是否超出随机波动。原文报告了检验统计量与显著性,但未报告效应量置信区间与原始试次级数据,因此只能复述方向与显著性,不能重构精确的个体分布。
被试、试次与剔除规则是否一致可比?
比较是否公平,首先看被试与任务是否对齐。两组各 17 人,一组为日语母语者,另一组为无日语经验的法语母语者,任务对两组完全相同,都是听 10 级刺激并做二选一词判断。这种设计使听觉输入与任务要求保持一致,组间差异可以归因于母语背景,而不是刺激或指导语不同。需要指出,论文未报告年龄、听力筛查、利手或语言背景问卷细节,这些是复现时需要补记的缺项。
其次看试次量与剔除是否一致。下表把人数、刺激级数、总试次数与剔除规则放在一起,便于核对实验规模与有效数据比例。所有数字均来自正文连续句,不做单位换算与四舍五入。
本表要回答的比较问题是两组被试是否在相同数据量下完成相同任务,公平条件是刺激连续体、试次总数与熟悉试次剔除规则对两组相同,指标方向是有效试次数越多估计越稳定。
| 组别与任务 | 人数 | 刺激级数 | 总试次数 | 熟悉试次剔除 |
|---|---|---|---|---|
| 日语母语组,短长元音词二选一 | 17 人 | 10 个刺激 | 800 次 | 前 160 次不纳入分析 |
| 法语母语组,无日语经验,相同二选一 | 17 人 | 10 个刺激 | 800 次 | 前 160 次不纳入分析 |
表后需要说明主要收益与代价。每组 17 人在心理物理实验中属于中等样本,被试内条件比较提高了统计效率,八百试次减去一百六十熟悉试次后仍保留较多有效试次,有利于稳定估计平均比例。代价是前一百六十试次一律丢弃,若学习效应延续更久或存在条件特异的适应,剩余数据仍可能受时间趋势影响;论文采用短块交替来缓解,但未报告时间趋势检验,因此不能排除残余漂移。未胜出的边界是法语组缺乏时长类别,其数据不能用来证明体感对时长完全无效,只能说明在当前任务与当前拉伸参数下未观察到显著偏向。
指标如何聚合,统计比较了谁与谁?
指标聚合分两条线。第一条是偏向线,对每个被试计算全部刺激上报告长元音的平均比例,再比较有体感与无体感两种条件的均值。这里的聚合对象是被试内的全部有效试次,而不是某个刺激级,因此它反映整体向上或向下的移动,而不是某 1 级的特异变化。第二条是敏感性线,仅用对照条件的数据拟合心理测量函数并提取斜率,再在组间比较。聚合对象同样是被试,但数据来源限定为无拉伸条件,以避免体感本身污染基线敏感性估计。
统计比较也分两层。组内层用方差分析检验条件主效应,再用事后检验分别看日语组与法语组内部的条件差异;组间层比较两组在对照条件下的斜率。自由度的写法保留原文,例如方差分析为一与三十二,配对检验为十六,组间检验出现了小数自由度,提示使用了校正方差不齐的方法,但论文未展开说明校正细节。复现时应保留相同的比较结构,并明确记录所用检验类型与方差假设。
一个容易混淆的点是百分点与百分比。报告长元音比例的变化是比例差,应理解为百分点移动,而不是相对增长率。论文只报告了显著性与检验统计量,未报告平均差值的具体百分点与置信区间,因此不能从显著性反推效应大小,也不能把显著等同于大效应。
体感拉伸是否让长元音反应变多?谁变谁没变?
论文直接报告的结果是存在体感条件的总体效应,方差分析显示条件主效应显著。进一步的事后检验显示,日语组在有拉伸时报告长元音的比例显著升高,而法语组的变化未达到显著。作者据此表述为该效应可能特异地出现在日语组。另一项直接报告是敏感性差异:法语组的斜率显著低于日语组,说明在没有体感的基线条件下,法语组随物理时长改变判断的能力更弱,这与母语中缺乏时长对比的预期一致。
母语经验 × 体感偏向: 母语经验分工是决定被试内部是否已建立长短元音的稳定类别,日语组有而法语组无;体感偏向分工是量化有无皮肤拉伸时报告长元音比例的差值;二者搭配的理由是若体感效应依赖已有的多感觉音位表征,则偏向应只在日语组出现,组合意义在于把组间差异解释为表征差异的证据,而不是单纯的听觉灵敏度差异。
下表要回答的核心问题是在相同统计框架下哪一组显示了可部署的体感偏向,公平条件是两组完成相同试次与相同条件交替,指标方向是报告长元音比例越高越支持偏向存在,斜率越大表示敏感性越高。表中检验值与显著性保留原文写法,不做四舍五入与单位追加。
| 比较对象 | 指标 | 检验统计量 | 显著性 | 论文报告的判断 |
|---|---|---|---|---|
| 全部被试,有拉伸与无拉伸 | 长元音平均比例条件效应 | F(1,32) = 7.19 | p = .012 | 条件主效应显著 |
| 日语组内,有拉伸与无拉伸 | 长元音比例变化 | t(16) = -2.52 | p = .045 | 比例显著升高 |
| 法语组内,有拉伸与无拉伸 | 长元音比例变化 | t(16) = -1,47 | p = .16 | 未达到显著 |
| 法语组与日语组,对照条件 | 心理测量函数斜率 | t(29.37) = 4.44 | p < .001 | 法语组敏感性更低 |
表后解释主要收益与具体代价。收益是两条证据互相支撑:日语组既有更高的基线斜率,又显示体感偏向,而法语组基线斜率更低且偏向不显著,这与体感效应依赖已有时长类别的解释相容。代价是显著性边界并不宽,日语组内检验的显著性刚过常规阈值,且论文未报告效应量与个体分布,无法判断效应是否由少数被试驱动。未胜出项是法语组的非显著结果,它不是证明无效,而是未能拒绝无偏向假设,在更大样本或不同拉伸参数下结论可能改变。
若拿掉母语类别或体感线索,结果会怎样变化?
论文没有做计算意义上的消融实验,但其组间设计起到了类似对照的作用。可以把法语组理解为自然缺失时长类别的一组:如果把时长类别拿掉,体感偏向不再显著,基线斜率也更低。这支持偏向与敏感性都与母语表征有关,但由于组间还可能存在其他差异,例如对日语语音的熟悉度、任务策略或注意力分配,因此这种对照是相关性证据,不是因果证明。
另一类反证来自条件对比本身。如果拿掉体感拉伸,只看对照条件,两组仍存在斜率差异,说明母语带来的敏感性差异独立于体感操作。反过来,如果只看有体感条件而不设对照,就无法区分偏向是拉伸引起的还是被试本身更爱选长元音。因此,对照条件的存在是因果链条中不可省略的一环。论文未测试的边界包括不同拉伸方向、不同拉伸时长、非语音时长判断以及仅改变频谱的刺激,这些未评测条件意味着结论目前只适用于口面部向后拉伸与元音时长任务的组合,不能推广到所有体感与所有语音维度。
对初学者而言,关键是区分两种不支持的过度解读。第一,不能因为法语组不显著就断言法国人听不出时长;斜率更低只表示类别任务中利用时长信息的能力较弱,不等于听觉阈限本身受损。第二,不能因为日语组显著就断言体感改善了识别准确率;论文比较的是报告长元音的比例,而不是正确率,因为中间刺激本就没有唯一正确答案,偏向增加不等于判断更准。
哪些证据缺失,哪些推论只能算待验证?
首先区分论文直接报告、有限解释与未验证推测。直接报告的是条件主效应显著、日语组内偏向显著、法语组内不显著、法语组斜率更低。有限解释是体感影响元音时长感知,且可能与母语表征有关,这一解释与数据相容但未排除其他机制。未验证推测是内部存在联合听觉与体感的感觉运动表征,以及这种表征帮助了时长感知,这些表述在讨论部分以可能的方式提出,没有直接的神经或建模证据。
具体缺项需要逐一记录。刺激方面,未报告每 1 级的时长数值、合成方法与归一化细节,无法精确重建连续体。体感方面,未报告拉伸幅度、力或位移曲线、设备与校准方法,只知道位置、方向与时长对应关系。分析方面,未报告心理测量函数的具体形式、拟合软件、斜率定义、效应量与置信区间,也未报告试次级数据的分布与排除标准之外的剔除。被试方面,未报告听力筛查与语言背景细节。资源方面,本次未发现来源绑定且完成验证的公开代码、模型或数据,因此不得声称数据或代码已公开,复现只能按正文文字重建。
这些缺失不是技术错误,而是可重复性上的限制。它们决定了复现时必须做出额外选择,而这些选择可能改变结果。因此,任何复现报告都应明确标注哪些参数是原文给定的,哪些是自行补足的,并在讨论中说明补足部分带来的不确定性。
要复现这项实验,先做什么、记什么?
复现的第一步是重建听觉连续体。按论文描述准备从短元音词到长元音词的 10 级刺激,仅改变元音持续时间并保持等步长,指导语要求被试在两种词拼写之间二选一。由于原文未给出具体时长,建议先做小规模预实验确定两端能被目标母语者稳定识别,再等分中间级,并在报告中完整公布所用时长与合成流程,以便他人核对。
第二步是实现体感条件与交替 schedule。体感为口面部皮肤向后拉伸,持续时间对应长元音时长;对照为无拉伸。两种条件每十试次交替并伪随机化,总试次为八百,前一百六十试次作为熟悉阶段不纳入分析。实施时需记录拉伸装置、固定方式、幅度校准、触发时序与听觉播放的同步精度,因为同步误差会直接改变体感时间窗与听觉时长的对应关系。
第三步是固定分析管线。先按被试计算两种条件下报告长元音的平均比例并求差,再用方差分析检验条件效应并分别做组内比较;另在对照条件下拟合心理测量函数提取斜率并做组间比较。复现时应预先写明拟合函数、斜率计算、检验类型与多重比较校正,并在结果中同时报告差值、置信区间与个体点分布,而不仅报告显著性。何时值得尝试这类体感操作,取决于研究目标是否为检验已有音位类别的多感觉性质;若目标只是提高识别率或验证设备效果,则本范式不直接适用,还需补充正确率、反应时与成本测量才能评估实用价值。
学完本文应带走什么判断?
带走的核心判断有 3 层。第一层是现象:在当前实验条件下,口面部皮肤拉伸伴随语音出现时,日语母语者更倾向于报告长元音,而无法语经验的法语母语者未显示显著变化。第二层是基线:即使没有拉伸,法语组利用时长做类别判断的敏感性也更低,这与母语中是否存在时长对比的预期一致。第 3 层是解释:作者认为这种模式支持时长表征可能是感觉运动性的,并与母语音位经验相连,但该解释仍为可能而非证实。
对语音与音频方向的学生,这个案例的教学价值在于展示如何用偏向与敏感性两条线回答不同问题。平均比例的变化回答是否被推动,斜率回答是否听得更敏锐,二者不可互相替代。同时,它提醒在跨母语比较中保持任务与刺激一致的重要性,否则组间差异无法归因。
最后要保留适用条件与开放验证。结论目前只在短长元音词辨别、向后口面部拉伸、短块交替与剔除熟悉试次的组合下成立;拉伸参数、连续体构造、拟合选择与样本规模都可能影响结果。下一步最需要补的验证是公布完整刺激参数与分析代码、报告效应量与个体差异、测试不同拉伸条件与非语音时长任务,以检验效应是否特异于语言类别还是一般的时长偏差。只有补足这些,才能判断体感在时长感知中的角色究竟有多大、多稳。
📐 原文公式与排版
以下展示论文原页中的数学表达区域,保留原始上下标、分式和符号排版。区域序号仅用于本文导航,不是论文公式编号。
另有 5 个候选区域因边界不明确或图片数量、尺寸限制未展开;请查看完整论文中的原始排版。
⚖️ 评分明细
评分属于系统判断,不是论文实验结果;八维数值与总分见页首,原始审计记录保留在后端。
- 评分规则:type-aware-v1
- 评分模型:muse-spark-1.3-contributor
- 评分请求协议:openai_responses