论文解读

Leveraging prediction entropy for Automatic prompt weighting in Zero-Shot Audio-Language Classification

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4393 字 阅读 →
论文解读

Modeling Inter-Segment Relationships in Speech for Dementia Detection with Audio Spectrogram Transformers and Graph Attention Networks

语音生物标志物 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4152 字 阅读 →
论文解读

More Than a Shortcut: A Hyperbolic Approach to Early-Exit Networks

音频事件检测 | 8.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5144 字 阅读 →
论文解读

Noise-Robust Contrastive Learning with an MFCC-Conformer for Coronary Artery Disease Detection

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5224 字 阅读 →
论文解读

Non-Line-of-Sight Vehicle Detection via Audio-Visual Fusion

音频分类 | 8.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4086 字 阅读 →
论文解读

One Model–Three Tasks: Discovering a Shared Winning Ticket for Low-Complexity Audio Intelligence

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3730 字 阅读 →
论文解读

Optimizing Domain-Adaptive Self-Supervised Learning for Clinical Voice-Based Disease Classification

语音生物标志物 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4984 字 阅读 →
论文解读

PADAM: Perceptual Audio Defect Assessment Model

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4814 字 阅读 →
论文解读

PC-MCL: Patient-Consistent Multi-Cycle Learning with Multi-Label Bias Correction for Respiratory Sound Classification

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 5005 字 阅读 →
论文解读

Reading Between the Waves: Robust Topic Segmentation Using Inter-Sentence Audio Features

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5113 字 阅读 →
论文解读

Reliable AI via Age-Balanced Validation: Fair Model Selection for Parkinson’s Detection from Voice

语音生物标志物 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4513 字 阅读 →
论文解读

RMODGDF: A Robust STFT-Derived Feature for Musical Instrument Recognition

音乐信息检索 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4290 字 阅读 →
论文解读

S-SONDO: Self-Supervised Knowledge Distillation for General Audio Foundation Models

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4416 字 阅读 →
论文解读

Semantic-Guided Pseudo-Feature Attention Network for Audio-Visual Zero-Shot Learning

音频分类 零样本学习 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4921 字 阅读 →
论文解读

SLAP: Scalable Language-Audio Pretraining with Variable-Duration Audio and Multi-Objective Training

音频检索 | 8.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4546 字 阅读 →
论文解读

Snore Sound Classification Based on Physiological Features and Adaptive Loss Function

音频分类 | 6.5/10

 · 更新于 2026-09-25 · 约 11 分钟 · 5116 字 阅读 →
论文解读

Speech Emotion Recognition based on Hierarchical Transformer with Shifted Windows

语音情感识别 | 8.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4324 字 阅读 →
论文解读

Spiking Temporal-Enhanced Network for Zero-Shot Audio-Visual Learning

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4341 字 阅读 →
论文解读

Testing The Efficient Coding Hypothesis Beyond Humans: The Auditory Kernels of Bat Vocalizations

生物声学 | 7.5/10

 · 更新于 2026-09-25 · 约 8 分钟 · 3800 字 阅读 →
论文解读

Thinking While Listening: Simple Test Time Scaling for Audio Classification

音频分类 | 6.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4620 字 阅读 →