论文解读

谁来打标签、谁来稳住训练:半监督联邦语音识别的在线教师与服务器锚点

该文研究服务器只有少量标注种子、客户端只有无标注语音的半监督联邦 ASR,用每客户端在线教师打伪标签加轮间服务器有监督更新做锚点,最强证据是稳定后在线教师在域内和多数跨域上持平或超过全局教师,代价是必须把服务器增强强度和批量调进稳定区间否则发散。

 · 约 20 分钟 · 9640 字 阅读 →
论文解读

联邦多语语音大模型:编码器与解码器谁更怕客户端漂移

该研究在 316 个按说话人划分的多语联邦客户端上比较四种语音大模型与 FedAvg 和 FedProx,最强证据是 Whisper 加 EuroLLM 在解冻编码器并调低其学习率时取得 0.1170 词错率,而 FedProx 只在该多语解码器上有效,代价是联邦仍远差于集中训练且对编码器预训练类型高度敏感。

 · 更新于 2026-09-24 · 约 19 分钟 · 9442 字 阅读 →
论文解读

编码器与解码器更新差十倍时,按参数量分配的差分隐私裁剪为何崩溃

论文诊断单池逐层裁剪在语音大模型中的跨组件预算崩溃,提出双池 α-split 在保持联合灵敏度与全局 DP 保证不变下恢复可用词错误率,并以编码器 4.47 倍等效噪声换取语言模型仅 2.6% 开销。

 · 更新于 2026-09-24 · 约 17 分钟 · 8457 字 阅读 →
论文解读

SpeechLLM Meets Federated Learning for End-to-End ASR: English and Italian Case Studies

语音识别 | 7.1/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5520 字 阅读 →
论文解读

Unlocking In-Context Learning in Audio-Language Models from Decentralized Medical Audio

联邦学习 | 7/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5185 字 阅读 →
论文解读

Towards Personalized Federated Learning for Dysarthric Speech Recognition

语音识别 | 6.2/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5530 字 阅读 →
论文解读

Mitigating Stethoscope-Induced Shortcuts in Respiratory Sound Classification under Federated Domain Generalization with Causality-Inspired Interventions

音频分类 | 8.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5537 字 阅读 →
论文解读

Trustworthy Federated Label Distribution Learning under Annotation Quality Disparity

标签分布学习 | 8.0/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6635 字 阅读 →
论文解读

Cooperative Multi-Agent Reinforcement Learning for Adaptive Aggregation in Semi-Supervised Federated Learning with non-IID Data

联邦学习 | 7.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4379 字 阅读 →
论文解读

FED-PISA: Federated Voice Cloning Via Personalized Identity-Style Adaptation

语音克隆 | 8.0/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5699 字 阅读 →
会议任务专题

ICASSP 2026 - 联邦学习

共 1 篇 ICASSP 2026 联邦学习 方向论文

 · 更新于 2026-09-24 · 约 3 分钟 · 1503 字 阅读 →