论文解读

π-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows

长期助手 | 5.2/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4593 字 阅读 →
论文解读

Can Large Language Models Reliably Correct Errors in Low-Resource ASR? A Contamination-Aware Case Study on West Frisian

语音识别 | 7.5/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9491 字 阅读 →