论文解读

NaijaS2ST: A Multi-Accent Benchmark for Speech-to-Speech Translation in Low-Resource Nigerian Languages

这篇论文旨在解决非洲低资源语言在语音翻译(S2ST和S2TT)研究中面临的高质量、多口音平行语音数据严重匮乏的核心瓶颈。为此,作者构建了**NaijaS2ST**数据集,涵盖豪萨语、伊博语、约鲁巴语和尼日利亚皮钦语与英语的平行语音,每种语言约50小时,捕获了真实的说话者与口音多样性。基于此数据集,论

 · 更新于 2026-09-06 · 约 9 分钟 · 4148 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-20

共分析 24 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 50 分钟 · 24566 字 阅读 →
论文解读

Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models

本文旨在解决非侵入式语音质量评估在标注数据有限场景下的性能瓶颈。作者提出了GatherMOS框架,其核心是将大语言模型(如GPT-5)作为一个元评估器,通过精心设计的文本提示,融合多类异构信号:包括手

 · 更新于 2026-09-06 · 约 10 分钟 · 4519 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-19

共分析 42 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 94 分钟 · 46668 字 阅读 →
每日研究速递

语音/音乐/音频论文速递 2026-04-18

共分析 39 篇语音/AI 论文

 · 更新于 2026-09-06 · 约 276 分钟 · 137848 字 阅读 →