论文解读

Equipping Large Language Model with Directional Speech Understanding Capabilities

语音识别 语音翻译 | 7.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4467 字 阅读 →
论文解读

Exploring SSL Discrete Tokens for Multilingual Automatic Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5356 字 阅读 →
论文解读

FinHuBERT: Hierarchical Feature Imitating Networks for Low-Resource Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4221 字 阅读 →
论文解读

Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3543 字 阅读 →
论文解读

Frontend Token Enhancement for Token-Based Speech Recognition

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5397 字 阅读 →
论文解读

GLoRIA: Gated Low-Rank Interpretable Adaptation for Dialectal ASR

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4800 字 阅读 →
论文解读

Grey-Box Prompt Tuning With Graph Alignment for Speech-Language Models

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 12 分钟 · 5713 字 阅读 →
论文解读

How Far Do SSL Speech Models Listen for Tone? Temporal Focus of Tone Representation under Low-Resource Transfer

语音识别 | 6.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3861 字 阅读 →
会议任务专题

ICASSP 2026 - 语音识别

共 102 篇 ICASSP 2026 语音识别 方向论文

 · 更新于 2026-09-06 · 约 308 分钟 · 154187 字 阅读 →
论文解读

Identifying the Minimal and Maximal Phonetic Subspace of Speech Representations

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4910 字 阅读 →
论文解读

Impact of Phonetics on Speaker Identity in Adversarial Voice Attack

说话人验证 | 7.0/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3657 字 阅读 →
论文解读

Improving Automatic Speech Recognition by Mitigating Distortions Introduced by Speech Enhancement Under Drone Noise

语音识别 | 6.5/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4511 字 阅读 →
论文解读

Improving Contextual Asr Via Multi-Grained Fusion With Large Language Models

语音识别 | 8.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3976 字 阅读 →
论文解读

In-Sync: Adaptation of Speech Aware Large Language Models for ASR with Word level timestamp predictions

语音识别 | 7.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4573 字 阅读 →
论文解读

Input-Adaptive Differentiable Filterbanks via Hypernetworks for Robust Speech Processing

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4225 字 阅读 →
论文解读

Inverse-Hessian Regularization for Continual Learning in ASR

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4236 字 阅读 →
论文解读

Investigating The Effect Of Sentence-Level Syntactic Structure On Information Loss In The Human Auditory System

语音识别 | 7.0/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3548 字 阅读 →
论文解读

Joint Autoregressive Modeling of Multi-Talker Overlapped Speech Recognition and Translation

语音识别 语音翻译 | 7.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4119 字 阅读 →
论文解读

K-Function: Joint Pronunciation Transcription and Feedback for Evaluating Kids Language Function

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4671 字 阅读 →
论文解读

Language-Infused Retrieval-Augmented CTC with Adaptive Soft-Hard Gating for Robust Code-Switching ASR

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 7 分钟 · 3170 字 阅读 →