英文题目:Question Intonation in Bilingual Speakers of Bulgarian and Judeo-Spanish
会议身份:
conference:speechprosody:2026:conference-paper-id:gessinger26_speechprosody
✅ 来源为官方会议 PDF;表格与 Figure 按原文证据绑定。PDF 公式以原页区域图片展示,未冒称作者原始 TeX。
标签:#数据标注 #韵律 #多语言 #语音 #语音属性识别
评分:5.9/10 | 创新 1.2/2 | 技术严谨 1.0/1.5 | 实验充分 0.7/1.5 | 清晰度 0.7/1 | 影响力 0.5/1.5 | 开源 1.0/1.5 | 可复现 0.3/0.5 | 工程/实践 0.5/1.5
排名:前50% | 文档类型:应用研究
👥 作者与机构
- Iona Gessinger:机构信息未能从会议 PDF 纯文本可靠映射
- Bistra Andreeva:机构信息未能从会议 PDF 纯文本可靠映射
- Christoph Gabriel:机构信息未能从会议 PDF 纯文本可靠映射
- Jonas Grünke:机构信息未能从会议 PDF 纯文本可靠映射
📌 核心摘要
本研究输入为话语补全任务诱发的半自发疑问句录音,输出为是否问句、wh问句与选择问句的核重音与边界调型分布,难点在于濒危遗产语高龄发音人稀少且三类问句样本极不平衡。先将嵌入约10分钟话语补全任务的3个场景呈现给被试以诱发三类问句,其双语者先测保加利亚犹太西班牙语后测保加利亚语,得到的录音直接进入下一步切分。再对录音做词与音节层切分并剔除缺失、严重不流利或误解场景试次,保留的切分后试次全部进入合议标注。最后由作者团队按ToBI式框架合议标注核音高重音加边缘调构成的核轮廓,其中选择问句分前后两个韵律单位分别标注,标注结果用于组间比较。与聚焦陈述句趋同的前作不同,本文以疑问句检验语码区分与接触影响,揭示了双语者区分语码且偏离单语者的韵律变异机制。在DCT诱发疑问句语料任务下,BJS的YNQ高结尾占比指标为71%,高于单语BG的YNQ高结尾占比指标69%。结论适用边界受限于保加利亚老年双语者及诱发语体,尚未验证自然对话与年轻传承者的外推范围。原文未披露训练、推理或部署成本。
🔗 开源与复现资源
- 数据相关资源:https://osf.io/6kacx — 链接可访问(HTTP 200)
- 复现相关资源:https://osf.io/6kacx — 链接可访问(HTTP 200) 可达状态仅表示本次链接检查结果,不代表许可证、本文权重或运行复现已验证。
🧭 深度解读
这篇论文要回答什么问题?
输入是会议论文的正文文字与 3 张官方原图像素,目标是让刚进入语音与音乐音频领域的研究生能核对并复述方法与发现,必须保留的信息包括被试构成、诱发任务、标注体系、样本量与百分比分布,输出是 1 篇按学习依赖展开的中文技术解读。
研究对象是保加利亚犹太西班牙语,简称 BJS,它是历史上居住在保加利亚的塞法迪犹太人的遗产语言,现在会说的人不到 30 位,多数是 70 岁到 100 岁的老人,且以保加利亚语简称为 BG 为强势语言。论文要检验长期接触是否改变了问句语调,以及双语者是否还在两种语言中维持不同的语调模式。
白话先说问句类型:是非问句就是能用是或否回答的问话,例如你有橘子吗,特指问句就是带疑问词的问话,例如柠檬多少钱,选择问句就是给出两个选项的问话,例如你要香草冰淇淋还是蛋糕。英文名分别为 yes/no questions 简称为 YNQs、wh-questions 简称为 WHQs、alternative questions 简称为 AQs。后文统一用这 3 个简称。
是非问句 × 特指问句: 是非问句靠语调或疑问小品词 li 来区别于陈述,特指问句已有疑问词提供疑问信息而语调常不冗余标记,二者分工不同,因此不能用同一升降标准评判,本文把两者与选择问句分开统计。
论文提出两个研究问题:第一,双语者在 BJS 和 BG 中的语调模式有何不同;第二,双语者的 BG 与单语 BG 有何不同。摘要报告的总体模式是 BJS 的是非问句典型地以高结尾,特指问句以低结尾,选择问句第一成分以高结尾、第二成分以低结尾,而双语者的 BG 大体接近单语 BG 但有细微偏离。这为理解接触导致的韵律趋同与维持提供了证据。
术语速查与符号读法
为方便初学者回查,集中说明符号读法。L 星指重读节取低音,H 星指取高音,L 星加 H 指低后升,L 加 H 星指节内上升,上扬低音指上扬的低音,感叹号 H 星指导降阶高音。边界调中 L 减百分号为低降,L 减 H 百分号为低升,H 减百分号为高平台,H 减 H 百分号为高升。核轮廓即两者组合,例如 H 星加 L 减百分号表示高重音后低降。
问句类型、语言简称与任务简称在前文已固定,后文不再更改。所有数字均保留原文写法与精度,百分比的方向为占比越高越典型,百分点与相对百分比不混用,不同指标的差值不放入同一模型列比较。
西班牙语和保加利亚语的问句语调有何不同?
要理解比较基准,需要先看两种来源语言的已有描写。北部与中部半岛西班牙语的无标记信息寻求是非问句被描写为先降后升,核重读节取低音、句末上升,记为 L 星加 H 减 H 百分号;上升后下降被视为有标记语用,但在会话中也常见,而下降型多见于接触变体。特指问句因已有疑问词,语调常不冗余标记,典型是疑问词取高重音、核构型低降,记为 L 星加 L 减百分号,上升变体被解释为说话人投入度更高。选择问句第一韵律单位边界高于中性陈述,但两类都以低结尾。
保加利亚语的组织方式不同:是非问句通常用疑问小品词 li 跟在被疑问成分后,标记窄焦点,无标记信息寻求是非问句表现为宽的上升后下降,受焦点词重读节取低后升、句末低降,记为 L 星加 H 与 L 减百分号,句末低升则传递礼貌或惊讶。特指问句核重音落在疑问词上并以低降结尾,焦点后重音常降阶。选择问句第一单位上升、第二单位下降。
语言接触 × 遗产语言: 语言接触指保加利亚犹太西班牙语与保加利亚语长期共存导致的语音韵律趋同压力,遗产语言指该变体已不再代际传递且仅剩不到 30 名高龄使用者,前者解释为何趋同,后者解释为何样本小且变异大。
已有接触研究显示 BJS 在非重读元音高化、时长缩减、言语节奏以及陈述句重音与边界调库存上向索菲亚 BG 靠拢,呼语语调的分布虽有差异但库存共享。本文把这种趋同检验扩展到 3 类问句,教学例子是:若两种语言库存相同,差异应体现在同一轮廓在不同语用语境中的选择频率上,而非有无该轮廓本身。
与既有工作的同条件对照
同输入对照是既有 BJS 陈述句与呼语研究:它们报告了重音与边界调库存共享而语用分布不同,本文在问句中得到相一致的模式,即库存趋同而选择频率分化。同目标对照是半岛西班牙语与保加利亚语的问句描写:本文 BJS 的是非问句高结尾符合西班牙语预期,双语 BG 的低结尾偏向符合 BG 无标记模式。同监督对照是此前言语节奏与元音研究:它们用声学测量显示 BJS 介于索菲亚 BG 与卡斯蒂利亚西班牙语之间,本文用离散轮廓补充了语调层面的证据。
同运行阶段对照是半自发 DCT 与自然会话的差异:会话中西班牙语是非问句也常见升降变体,DCT 更易诱发无标记形式,因此本文的低降比例不能直接等同于日常频率。这种对照避免把类别差异当成同条件胜负,也为复现时选择诱发任务提供了依据。
比较被形式化为什么任务?
论文把问题形式化为 3 组产出的分布比较:双语者的 BJS、同一批双语者的 BG、单语对照组的 BG。输入是话语补全任务诱发的半自发问句录音,输出是对每句的核轮廓标注,再按问句类型聚合为百分比。
沿一个样本走完流程有助于建立直觉:以橘子场景为例,被试听到买水果的短情景后说出你有橘子吗,BJS 形式为 Tenesh mandarinas,BG 形式为 Imate li mandarini。录音先在词与音节层切分,再由作者团队联合标出核重音加边界调的组合,例如 H 星加 L 减百分号。单个样本的标注随后进入所属问句类型的计数,比较的是 3 组在同一类型上的轮廓构成是否一致。
关键是不把声学参数直接当结论,而是把离散音系类别当比较单位。升调还是降调不是看基频曲线某一点的高低,而是看核重音类型与句末边界调的组合归属。这种设计使跨语言比较可在同一 ToBI 式框架下进行,但也意味着结果依赖于标注者对重音位置与边界层级的判断。
方法全景:从诱发到标注如何串起来?
方法全景分为 4 步。第一步是用话语补全任务简称为 DCT 诱发目标问句,3 类问句嵌入在一个约 10 分钟的 DCT 中,DCT 又是约 90 分钟大测试的一部分,双语者先做 BJS 后做 BG,多数分 2 次会面完成。第二步是筛选与保留,排除缺添成分过多、严重不流利或误解情景的产出,因部分老人去世或拒绝提供 BG 而样本不平衡,个别多版本产出被保留。第三步是在词与音节层对齐后联合标注核轮廓,特指问句还加标句首疑问词重音。第 4 步是按百分比报告,以保证组间可比。
核重音 × 边界调: 核重音负责标记疑问句中最凸显的重读节上的音高动作,例如低后升或高平,边界调负责标记短语末尾的走向,例如高平台、低升或低降,二者搭配成核轮廓才能完整判定一句问话是升尾还是降尾,本研究正是把两者联合标注后比较分布。
ToBI 式标注 × 核轮廓: ToBI 式标注提供核重音加短语重音加边界音的离散符号体系,核轮廓是其中核重音与边界调的组合结果,前者是标注动作,后者是比较单位,本文用前者得到后者再算百分比。
补充材料与数据链接在正文中给出,资源状态显示补充材料与复现数据当前可用,链接为开放科学平台地址,状态码为 200。这意味着读者可核对情景文本与细分标注,但本解读的事实仍只依据本次收到的正文证据与原图像素,不引入外部推断。
标注组件如何切分重音与边界?
标注组件的核心是把连续基频曲线离散化为两部分。白话说,核重音是问句最后一个重要重读节上的音高动作,边界调是该韵律短语末尾的走向。英文分别为 nuclear pitch accent 和 edge tone,后者是短语重音加边界音的组合。
库存包括低后升、高内升、峰后移、单纯高音、降阶高音、早峰低音等重音,以及低升、高平台、高升、高降、低降等边界。选择问句按 or 连接的两个成分分别处理,若只形成一个韵律单位则只计入第二成分分析,第一成分的中间短语边界若为 H 减则与 H 减 H 百分号合并统计。
选择问句第一成分 × 选择问句第二成分: 选择问句第一成分承担延续功能而预期以高边界结束,第二成分承担终结功能而预期以低边界结束,只有把两个韵律单位分别标注核轮廓,才能检验说话人是否维持了这种延续与终结的分工。
操作上先沿样本走完输入到输出:输入为切分好的音节串与基频曲线,表示为核重音符号加边界调符号,组件根据重读节位置与末尾走向选符号,目标是得到可计数的核轮廓类别,输出为该句的类别标签。随后才展开跨句统计。原文未给出声学阈值或自动对齐器参数,因此复述时只能说人工联合标注,未报告处记为缺项,不从术语推定算法实现。
本研究训练了什么模型?
本研究没有训练神经网络模型,也没有优化器、梯度路径、参数冻结或重置环节,因此本节明确说明无训练阶段。真实计算过程是人工标注与计数统计:作者团队在词与音节标注基础上听辨并标出核重音与边界调,再按问句类型与语言组计算百分比。
这不是确定性求解,只是描述性分布比较。没有交叉验证、没有损失函数、没有超参数搜索。调用的外部资源是话语补全情景文本与开放科学平台上的补充材料,用于核对诱发条件与细分分布。复现者不需要准备算力,需要准备的是熟悉保加利亚语与犹太西班牙语的标注者、一致的切分规范以及对降阶与上扬符号的判定标准。未报告标注者一致性系数,这是具体缺项,复现时应补测。
被试、录音与样本量如何安排?
双语组为 18 名 BJS 与 BG 双语者,11 男 7 女,年龄 70 岁到 100 岁,平均 81 岁,来自索菲亚、普罗夫迪夫、布尔加斯、瓦尔纳等地。对照组为 18 名单语 BG 者,6 男 12 女,年龄 62 岁到 97 岁,平均 76 岁,按年龄、地点、教育与社会经济背景匹配。录音于 2022 年到 2023 年在被试家中或社区中心采集。
为说明标注结果对应什么样的信号,先看同一位索菲亚男性双语者的橘子是非问句在两种语言中的实现。上幅为 BJS,下幅为 BG,每幅自上而下为语图加基频黑线、重音与边界符号行、音节切分行。前导读指出这不是统计图,而是单一样本的声学加音系对照。
看图路径: 1. 先看上下两幅语图加基频曲线的对应关系,上为犹太西班牙语下为保加利亚语;2. 再看核重音符号位置:上图标在 RI 音节的 H 星,下图标在 RI 附近的上扬低音;3. 比较句末边界调同为低降时,句首与疑问小品词附近的曲线走向差异;4. 核对横轴音节切分与纵轴语图能量,确认这是单一样本而非分布统计
论文图 1。原论文 Figure 1:“YNQ “Do you have tangerines?” in BJS (top) and BG (bottom) by a male bilingual speaker from Sofia.”。
从像素可见,上幅基频在句首保持平缓后在 RI 音节形成高峰并在末音节 nas 处低降,符号标为 H 星加 L 减百分号;下幅基频在句首 I 与 ma 处先降后升,随后经 te、li、man 逐渐下降,在 RI 附近标为上扬低音加 L 减百分号,末音节 ni 延续低降。两句边界同为低降,但核重音类型与句首走向不同,这预示后文统计差异主要来自重音选择与边界高度,而非有无降尾本身。表 1 给出 3 类问句在两种语言中的例句,表 2 给出纳入分析的问句数。
下表为原表选择,直接呈现纳入分析的问句数。比较问题是 3 组样本是否平衡,公平条件是同一诱发任务与同一筛选标准,指标方向是数量越多估计越稳。表前说明已给出,表后解释见下段。
| Type | BJS | BG bilingual | BG monolingual |
|---|---|---|---|
| YNQ | 21 | 13 | 16 |
| WHQ | 16 | 13 | 18 |
| AQ | 15 | 14 | 18 |
表后解释:可见是非问句 21 比 13 比 16,特指问句 16 比 13 比 18,选择问句 15 比 14 比 18,双语 BG 的是非问句与特指问句略少,这与部分老人未能完成第二次录音有关。代价是百分比的分母较小,个别类别多一两句就会改变几个百分点,因此后文对小样本轮廓的排序需谨慎,未胜出项与长尾轮廓不能忽略。
数据处理与聚合口径
数据处理规则按原文交代:DCT 设计目标明确,被试一般产出预期形式,不符合者按缺添、不流利、误解 3 类排除。纳入分析的问句数已在表 2 中列出,另有 8 例多版本产出被纳入,跨 3 类问句分布。标注在词与音节层对齐后进行,核轮廓为核重音加边界调的组合,选择问句分 20% 分,特指问句加标句首疑问词重音,结果以百分比报告以保证可比。
聚合对象是语句数而非说话人数,未报告按说话人平均与统计检验,硬件预算与推理开销不适用。复述时应明确标注冲突之处:若图注样本量与正文表 2 在个别类型上差一两句,应以正文明确句为据并注明波动,不自行编造划分来圆成一致。本次解读未发现此类算术冲突,但提醒读者在复现计数时以补充材料为准。
是非问句与特指问句呈现什么分布?
先看是非问句。BJS 最频核重音为 L 加 H 星占 52%,其次 H 星占 29%;两种 BG 则以上扬低音与低音为主,双语 BG 各占 50% 与 25%,单语 BG 各占 44% 与 56%,单语 BG 无其他重音变体。边界调方面,BJS 最多为高平台占 38%,另有 19% 为高升;BG 多为低升或低降,双语 BG 低升 31% 低降 54%,单语 BG 低升 69% 低降 31%,BJS 也有低升 14% 与低降 24%。
组合后 BJS 以 L 加 H 星加高平台占 33%、L 加 H 星加高升占 14%、H 星加低降占 24% 为主,BG 以 L 星加低升与上扬低音加低降为主,两类在对方语言中至多出现 1 次。总体高结尾比例为 BJS 占 71%、单语 BG 占 69%、双语 BG 偏向低结尾占 54%。核轮廓种类为 BJS 有 8 种、双语 BG 有 6 种、单语 BG 仅 3 种。
下图为是非问句与特指问句的核重音、边界调与核轮廓百分比堆叠柱状图。前导读已说明行列含义,此处聚焦两类问句的组间翻转。
看图路径: 1. 先按行区分上半为是非问句、下半为特指问句,按列区分核重音、边界调、核轮廓;2. 再比较每列中三根柱子代表的群体:双语者的犹太西班牙语、双语者的保加利亚语、单语保加利亚语;3. 观察是非问句中高平台与低升的占比如何在三组之间翻转;4. 核对柱下样本量标注,确认百分比的分母随问句类型变化
论文图 2。原论文 Figure 2:“YNQs (top) and WHQs (bottom) — percentage distribution of nuclear accents, edge tones, and nuclear contours.”。
从像素可见,上排是非问句核重音柱中 BJS 绿色与深蓝段最大,中排边界调中 BJS 蓝色高平台段突出而单语 BG 绿色低升段占近 70%,右列核轮廓中 BJS 深蓝与棕色段与 BG 浅绿与浅橙段互补;下排特指问句核重音中 BJS 深蓝 H 星占 40%,边界调中 BJS 橙色低降占 60% 而单语 BG 绿色低升占 67%,核轮廓中 BJS 棕色 H 星加低降占 40%。这支持报告的判断:BJS 是非问句高结尾、特指问句低降,而 BG 的上升偏好可能与礼貌有关。
为便于核对关键数字,整理两张五列对照表。第一张问的是核重音与边界调在是非问句中如何错位,公平条件是同一 DCT 情景与同一标注库存,指标方向是占比越高越典型。表前问题与条件已交代,表后将解释收益与代价。
| 条件 | 指标 | 双语者 BJS | 双语者 BG | 单语 BG |
|---|---|---|---|---|
| 是非问句 | 核重音 L 加 H 星占比 | 52% | 未报告主导 | 未报告主导 |
| 是非问句 | 核重音 H 星占比 | 29% | 未报告主导 | 无 |
| 是非问句 | 核重音上扬低音占比 | 未报告主导 | 50% | 44% |
| 是非问句 | 核重音低音占比 | 未报告主导 | 25% | 56% |
| 是非问句 | 边界高平台占比 | 38% | 未报告主导 | 无 |
| 是非问句 | 边界低升占比 | 14% | 31% | 69% |
| 是非问句 | 边界低降占比 | 24% | 54% | 31% |
表后解释:主要收益是 BJS 的高重音加高边界组合在 BG 中几乎缺席,BG 的低音加低升组合在 BJS 中至多 1 次,显示双语者在两种语言中维持了不同选择。具体代价是双语 BG 的是非问句样本仅 12 到 13 句,轮廓种类却有 6 种,分布稀疏;未胜出项如 BJS 中的低升与低降合计也有 38%,不能说 BJS 只有高结尾。单语 BG 仅 3 种轮廓,变异最小,这与后文双语者变异更大的讨论相呼应。
再看特指问句。BJS 核重音最多为 H 星占 40%,其次低音占 27%、降阶高音占 20%;BG 也有可观低音与降阶高音,双语 BG 各占 39% 与 39%,单语 BG 各占 38% 与 19%,单语另偏好上扬低音占 44%。边界调均为低升与低降为主,BJS 低升 33% 低降 60%,双语 BG 低升 31% 低降 46%,单语 BG 低升 67% 低降 28%。组合后 BJS 偏好 H 星加低降占 40%,BG 有可观降阶高音加低降,双语 BG 占 23%、单语占 19%,3 组都有 L 星加低升,双语 BG 占 23%、单语占 38%、BJS 占 20%,单语另有上扬低音加低升占 31%。
句首疑问词重音多为高星,3 组各占 44% 到 46%,BJS 另有低后升 25% 与低加高星 31%,双语 BG 低后升 31% 常见,单语低加高星 39% 常见。轮廓种类为 BJS 与双语 BG 各 7 种、单语 BG 仅 4 种。
| 条件 | 指标 | 双语者 BJS | 双语者 BG | 单语 BG |
|---|---|---|---|---|
| 特指问句 | 核重音 H 星占比 | 40% | 未报告主导 | 未报告主导 |
| 特指问句 | 核重音低音占比 | 27% | 39% | 38% |
| 特指问句 | 核重音降阶高音占比 | 20% | 39% | 19% |
| 特指问句 | 核重音上扬低音占比 | 未报告主导 | 未报告主导 | 44% |
| 特指问句 | 边界低升占比 | 33% | 31% | 67% |
| 特指问句 | 边界低降占比 | 60% | 46% | 28% |
表后解释:主要收益是只有 BJS 的特指问句主要以低降结尾,符合两种语言的预期,而双语 BG 轻微偏向高结尾、单语 BG 强烈偏向高结尾,作者将其归因于礼貌的可能解释,属有限解释而非直接验证。具体代价是特指问句样本每组 15 到 18 句,细分到 7 种轮廓后多数类别仅两三例,排序易受偶然影响;未评测边界是不同礼貌语境未被系统操纵,因此不能断言上升即礼貌。
选择问句的两成分是否维持升降分工?
选择问句的检验逻辑类似消融中的条件对照:若说话人维持延续与终结分工,则第一成分应高结尾、第二成分应低结尾,与语言背景无关。多数两个成分分属不同韵律单位,BJS 占 80%、双语 BG 占 71%、单语 BG 占 83%,单单位产出只计入第二成分。
下图为选择问句 20% 分的核轮廓百分比分布,前导读已区分上下 20% 分,此处检验高低分工是否成立。
看图路径: 1. 先区分上图为选择问句第一成分、下图为第二成分,纵轴均为百分比;2. 再看第一成分是否集中在高边界组合,第二成分是否集中在低降组合;3. 比较三组在第一成分中上升重音加高边界的具体构成差异;4. 注意第二成分中感叹号标记的降阶高音加低降在三组中都出现
论文图 3。原论文 Figure 3:“AQs — percentage distribution of nuclear contours for first component [. . . dessert 1] (top) and second component [or dessert 2] (bottom).”。
从像素可见,上图第一成分各组柱子以高边界色段为主,下图第二成分几乎全为低降色段;第一成分中 3 组共有的上升重音加高升组合在 BJS 占 25%、双语 BG 占 30%、单语占 40%,BJS 另有高平台与低重音变体,BG 双语另有高星加高升占 30%、单语另有低后升加高升占 33%;第二成分 3 组共有的降阶高音加低降各占 33% 到 43%,BJS 另有高星加低降 33% 与低星加低降 27%,两种 BG 另有高加降阶高音加低降各占约 20%。这显示分工总体成立,差异在具体重音选型。另一特有细节是 BG 中香草冰淇淋名词短语有时两个成分都带重音,双语 4 例、单语 3 例,而 BJS 无此现象且重音不前移,作者认为这可能与结构平行性有关,属待验证解释。
总体变异模式为是非问句与特指问句中双语者轮廓种类多于单语者,而选择问句中单语者种类最多,BJS 为 4 种、双语 BG 为 5 种、单语 BG 为 6 种。这支持双语者韵律变异更大的已有发现,但也表明特定语境可减弱该差异。
样本与推论的边界在哪里?
直接报告的局限是数据集较小,原因是遗产语言不再代际传递,可用说话人自然受限。分析仍能识别系统模式,但百分比的分母多在 12 到 21 之间,长尾类别的排序不稳。
有限解释包括礼貌归因与情感投入差异:单语 BG 的是非问句低升偏好与特指问句高结尾偏好被解释为可能与礼貌有关,双语者语言间的差异也被认为可能源于 heritage 语言自信不足或情感卷入不同。这些是支持性推测而非操纵验证,相关性不是因果,未测量礼貌评级、语境正式度或心理量表。
未验证推测还包括借用依赖结构平行性的论点,即 BG 双重重音未进入 BJS 是因为 BJS 的复合名词与 BG 的形容词附加结构不被识别为平行。这引用了接触导致语法化文献,但本文未独立检验句法表征。复述时应对这 3 类表述分别使用报告、支持、可能待验证的措辞,不承诺未测量的误判率、延迟或成本改善。
要复现需要准备什么?
复现先做三件事。第一,从开放科学平台获取补充材料 1 的 DCT 情景文本与补充材料 2 至 3 的细分分布,确认 3 类问句的诱发语境与疑问词重音标注口径,当前资源状态显示可用且状态码为 200。第二,按原文招募与匹配标准记录年龄、地点、教育背景,录音环境保持家中或社区中心的安静条件,记录采集年份,双语者先做 BJS 后做 BG。第三,复刻筛选规则:排除缺添成分、不流利与误解情景,保留多版本时注明句数,标注时联合判定核重音与边界调,并对选择问句的 20% 分与中间短语边界做同样归并。
还需补的验证包括标注者一致性、按说话人聚合与按语句聚合的差异、以及礼貌语境的系统操纵。若要比较新变体,应保留原文实际可运行的策略,即同一 DCT 加同一 ToBI 式库存加百分比报告,不用事后最优轮廓代替可部署的分布描述。代码开源与权重下载不适用本研究,可运行的是标注规范与统计脚本,复现者应公开切分文件与轮廓计数表以便核对。
何时值得参考这项发现?
当研究问题涉及接触导致的韵律趋同而非音段趋同时,这项发现值得尝试:双语者在 BJS 与 BG 中维持了不同的问句语调选择,BJS 的是非问句高结尾、特指问句低降、选择问句前升后降更接近西班牙语预期,而双语者的 BG 更接近单语 BG。这显示即使在几乎不再日常使用的遗产语言中,长期接触的影响与区别性模式仍可共存。
不值得过度推广的是把某一轮廓当作某语言的唯一标记:每类问句内部都有多种轮廓,BJS 的是非问句也有低降,BG 的特指问句也有低降,总体趋势不等于每位说话人每句都如此。教学误解澄清是:高结尾不等于疑问本身,疑问可由疑问词或小品词承担,语调负责叠加语用与结构信息;同色堆叠段不必然同对象,读图须先核对图例与分母。
收束回答两个研究问题:跨语言比较显示双语者随语言切换轮廓,双语与单语比较显示双语 BG 大体趋同但有 heritage 痕迹。未来需在更大样本与操纵礼貌的条件下验证上升偏好的来源,并补测感知实验以确认分布差异是否影响听者判断。
📐 原文公式与排版
以下展示论文原页中的数学表达区域,保留原始上下标、分式和符号排版。区域序号仅用于本文导航,不是论文公式编号。
另有 28 个候选区域因边界不明确或图片数量、尺寸限制未展开;请查看完整论文中的原始排版。
⚖️ 评分明细
评分属于系统判断,不是论文实验结果;八维数值与总分见页首,原始审计记录保留在后端。
- 评分规则:type-aware-v1
- 评分模型:muse-spark-1.3-contributor
- 评分请求协议:openai_responses


