论文解读

Mitigating Stethoscope-Induced Shortcuts in Respiratory Sound Classification under Federated Domain Generalization with Causality-Inspired Interventions

音频分类 | 8.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5537 字 阅读 →
论文解读

Evaluating the Temporal Detection Capability of Integrated Gradients Applied on Sound Classifier

音频分类 | 10/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5831 字 阅读 →
论文解读

CoarseSoundNet: Building a reliable model for ecological soundscape analysis

音频分类 | 8.5/10

 · 更新于 2026-09-25 · 约 17 分钟 · 8312 字 阅读 →
论文解读

EnvTriCascade: An Environment-Aware Tri-Stage Cascaded Framework for ESDD2 2026 Challenge

音频深度伪造检测 | 5.3/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9344 字 阅读 →
论文解读

Beyond Content: A Comprehensive Speech Toxicity Dataset and Detection Framework Incorporating Paralinguistic Cues

音频分类 | 6.5/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7338 字 阅读 →
论文解读

Scalable neuromorphic computing from autonomous spiking dynamics in a clockless reconfigurable chip

音频分类 | 7.8/10

 · 更新于 2026-09-25 · 约 18 分钟 · 8807 字 阅读 →
论文解读

AudioMosaic: Contrastive Masked Audio Representation Learning

音频分类 | 7.3/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7392 字 阅读 →
论文解读

Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study

音频分类 | 5.5/10

 · 更新于 2026-09-25 · 约 19 分钟 · 9405 字 阅读 →
论文解读

Does language matter for spoken word classification? A multilingual generative meta-learning approach

音频分类 | 6.0/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7080 字 阅读 →
论文解读

Scaling few-shot spoken word classification with generative meta-continual learning

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 15 分钟 · 7189 字 阅读 →
论文解读

APEX: Audio Prototype EXplanations for Classification Tasks

音频分类 | 6.2/10

 · 更新于 2026-09-25 · 约 20 分钟 · 9804 字 阅读 →
论文解读

Benchmarking LLMs on the Massive Sound Embedding Benchmark (MSEB)

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 5 分钟 · 2190 字 阅读 →
论文解读

Hearing the Ocean: Bio-inspired Gammatone-CNN framework for Robust Underwater Acoustic Target Classification

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4734 字 阅读 →
论文解读

OceanPile: A Large-Scale Multimodal Ocean Corpus for Foundation Models

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 9 分钟 · 4468 字 阅读 →
论文解读

Smart Passive Acoustic Monitoring: Embedding a Classifier on AudioMoth Microcontroller

生物声学 | 7.5/10

 · 更新于 2026-09-25 · 约 6 分钟 · 2580 字 阅读 →
论文解读

HARMES: A Multi-Modal Dataset for Wearable Human Activity Recognition with Motion, Environmental Sensing and Sound

音频分类 | 8.0/10

 · 更新于 2026-09-25 · 约 13 分钟 · 6251 字 阅读 →
论文解读

Integrating acoustic tapping with a UAV platform for tile condition classification

音频分类 | 7.5/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4811 字 阅读 →
论文解读

MultiSense-Pneumo: A Multimodal Learning Framework for Pneumonia Screening in Resource-Constrained Settings

肺炎筛查 | 6.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5935 字 阅读 →
论文解读

Private Speech Classification without Collapse: Stabilized DP Training and Offline Distillation

音频分类 | 6.5/10

 · 更新于 2026-09-25 · 约 12 分钟 · 5535 字 阅读 →
论文解读

Better Together: Leveraging Unpaired Multimodal Data for Stronger Unimodal Models

音频分类 | 7.0/10

 · 更新于 2026-09-25 · 约 10 分钟 · 4990 字 阅读 →