论文解读

Domain-Invariant Representation Learning of Bird Sounds

生物声学 | 6.5/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5091 字 阅读 →
论文解读

Dynamic Spectrogram Analysis with Local-Aware Graph Networks for Audio Anti-Spoofing

音频深度伪造检测 | 8.5/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4971 字 阅读 →
论文解读

ECHO: Frequency-Aware Hierarchical Encoding for Variable-Length Signals

音频分类 | 9.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4374 字 阅读 →
论文解读

ECSA: Dual-Branch Emotion Compensation for Emotion-Consistent Speaker Anonymization

语音匿名化 | 8.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4486 字 阅读 →
论文解读

EdgeSpot: Efficient and High-Performance Few-Shot Model for Keyword Spotting

语音活动检测 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4076 字 阅读 →
论文解读

Efficient Solutions for Mitigating Initialization Bias in Unsupervised Self-Adaptive Auditory Attention Decoding

听觉注意解码 | 8.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3989 字 阅读 →
论文解读

Encoding Emotion Through Self-Supervised Eye Movement Reconstruction

语音情感识别 | 7.5/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5306 字 阅读 →
论文解读

Enhancing Noise Robustness for Neural Speech Codecs Through Resource-Efficient Progressive Quantization Perturbation Simulation

语音增强 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4043 字 阅读 →
论文解读

Evaluating Compositional Structure in Audio Representations

模型评估 | 7.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4315 字 阅读 →
论文解读

Exploring SSL Discrete Tokens for Multilingual Automatic Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5356 字 阅读 →
论文解读

Expressive Voice Conversion with Controllable Emotional Intensity

语音转换 | 7.5/10

 · 更新于 2026-09-06 · 约 12 分钟 · 5587 字 阅读 →
论文解读

Fake Speech Wild: Detecting Deepfake Speech on Social Media Platform

语音伪造检测 | 7.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4224 字 阅读 →
论文解读

Fine-Grained Frame Modeling in Multi-Head Self-Attention for Speech Deepfake Detection

语音伪造检测 | 8.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4097 字 阅读 →
论文解读

FinHuBERT: Hierarchical Feature Imitating Networks for Low-Resource Speech Recognition

语音识别 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4221 字 阅读 →
论文解读

From Hallucination to Articulation: Language Model-Driven Losses for Ultra Low-Bitrate Neural Speech Coding

语音合成 | 7.5/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4405 字 阅读 →
论文解读

Frontend Token Enhancement for Token-Based Speech Recognition

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 11 分钟 · 5397 字 阅读 →
论文解读

Hanui: Harnessing Distributional Discrepancies for Singing Voice Deepfake Detection

音频深度伪造检测 | 8.0/10

 · 更新于 2026-09-06 · 约 9 分钟 · 4470 字 阅读 →
论文解读

How Far Do SSL Speech Models Listen for Tone? Temporal Focus of Tone Representation under Low-Resource Transfer

语音识别 | 6.5/10

 · 更新于 2026-09-06 · 约 8 分钟 · 3861 字 阅读 →
论文解读

Hybrid Pruning: In-Situ Compression of Self-Supervised Speech Models for Speaker Verification and Anti-Spoofing

说话人验证 | 8.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4788 字 阅读 →
论文解读

Identifying the Minimal and Maximal Phonetic Subspace of Speech Representations

语音识别 | 8.0/10

 · 更新于 2026-09-06 · 约 10 分钟 · 4910 字 阅读 →