论文解读

Confidence-Guided Error Correction for Disordered Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4863 字 阅读 →
论文解读

Content-Preserving Speech Representation Learning Via Adaptive Segment-Level Alignment

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5415 字 阅读 →
论文解读

Contextual Biasing for ASR in Speech LLM with Common Word Cues and Bias Word Position Prediction

语音识别 | 7.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5305 字 阅读 →
论文解读

Cross-Cultural Bias in Mel-Scale Representations: Evidence and Alternatives from Speech and Music

语音识别 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4247 字 阅读 →
论文解读

Cross-Modal Bottleneck Fusion for Noise Robust Audio-Visual Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4237 字 阅读 →
论文解读

CTC-DID: CTC-Based Arabic Dialect Identification for Streaming Applications

语音识别 | 6.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4764 字 阅读 →
论文解读

Decoder-Only Conformer with Modality-Aware Sparse Mixtures of Experts for ASR

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5265 字 阅读 →
论文解读

Do we really need self-attention for streaming automatic speech recognition?

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4519 字 阅读 →
论文解读

Domain-Aware Scheduling for ASR Fine-Tuning

语音识别 | 6.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4493 字 阅读 →
论文解读

Emilia-NV: A Non-Verbal Speech Dataset with Word-Level Annotation for Human-Like Speech Modeling

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4512 字 阅读 →
论文解读

Equipping Large Language Model with Directional Speech Understanding Capabilities

语音识别 语音翻译 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4467 字 阅读 →
论文解读

Exploring SSL Discrete Tokens for Multilingual Automatic Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5356 字 阅读 →
论文解读

FinHuBERT: Hierarchical Feature Imitating Networks for Low-Resource Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4221 字 阅读 →
论文解读

Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks

语音识别 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3543 字 阅读 →
论文解读

Frontend Token Enhancement for Token-Based Speech Recognition

语音识别 | 8.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5397 字 阅读 →
论文解读

GLoRIA: Gated Low-Rank Interpretable Adaptation for Dialectal ASR

语音识别 | 8.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4800 字 阅读 →
论文解读

Grey-Box Prompt Tuning With Graph Alignment for Speech-Language Models

语音识别 | 8.0/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5713 字 阅读 →
论文解读

How Far Do SSL Speech Models Listen for Tone? Temporal Focus of Tone Representation under Low-Resource Transfer

语音识别 | 6.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3861 字 阅读 →
会议任务专题

ICASSP 2026 - 语音识别

共 102 篇 ICASSP 2026 语音识别 方向论文

 · 更新于 2026-09-25 · 约 308 分钟 · 154187 字 阅读 →
论文解读

Identifying the Minimal and Maximal Phonetic Subspace of Speech Representations

语音识别 | 8.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4910 字 阅读 →