论文解读

What Makes a Good Layer? Assessing the Layer-Wise Intrinsic Properties of Music Foundation Models

音乐理解 | 7.7/10

 · 更新于 2026-09-24 · 约 16 分钟 · 8007 字 阅读 →
论文解读

Comparative Analysis of Multilingual Pre-trained Models for Nepali Automatic Speech Recognition

语音识别 | 7.6/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7343 字 阅读 →
论文解读

Motor, Cognitive, or Corpus? What Survives Cross-Lingual Transfer in Speech-Based Parkinsons Disease Detection

语音属性识别 | 6.1/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6657 字 阅读 →
论文解读

DonorRank: Donor Language Selection for Low-Resource Cross-Lingual Speech Recognition

语音识别 | 6.6/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4656 字 阅读 →
论文解读

Easper: An Accessible ASR Pipeline for Language Documentation

语音识别 | 7.0/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5955 字 阅读 →
论文解读

Measuring Cross-Cultural Style Diffusion Through Era Classification: US and Korean Popular Music

音乐理解 | 8.3/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7089 字 阅读 →
论文解读

Transfer Learning for Avian Bioacoustics under Sparse Positive Labels

音频分类 | 7.1/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6968 字 阅读 →
论文解读

Gecko: Fast Private Inference via Secure Public Encoder Offloading

迁移学习 | 6.9/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7533 字 阅读 →
论文解读

Does EEG Foundation Models Transfer to Speech? A Benchmark on Overt and Imagined Speech Decoding

语音识别 | 6.5/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5912 字 阅读 →
论文解读

Self-Supervised Audio Representation Learning for Pediatric Asthma Detection in Emergency Care Using Digital Stethoscope Recordings

音频分类 | 5.0/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5443 字 阅读 →
论文解读

Looking for Affect in Spontaneous Finnish Speech through Linguistic Interpretability

语音情感识别 | 5.3/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5152 字 阅读 →
论文解读

Phonetic forced alignment for low-resource language varieties: Model training and evaluation on Chengdu Mandarin

语音识别 | 6.2/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7221 字 阅读 →
论文解读

Cross-Subject Semantic Decoding with Shared-Space Alignment for Generalized Neural Representation Learning

语音交互 | 6.3/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6689 字 阅读 →
论文解读

Can Tokens Compete? Token Representations against Supervised CNN Backbones for BirdCLEF+ 2026

音频事件检测 | 8.3/10

 · 更新于 2026-09-24 · 约 19 分钟 · 9493 字 阅读 →
论文解读

Adapting a Diffusion-Based Music Synthesis Model to Human Voice Conversion

语音转换 | 6.0/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8922 字 阅读 →
论文解读

MetaPerch: Learning from metadata for bioacoustics foundation models

音频分类 | 9.0/10

 · 更新于 2026-09-24 · 约 22 分钟 · 10694 字 阅读 →
论文解读

Hybrid Continual Learning for Low-Resource Australian Aboriginal Language Identification

语音识别 | 6.3/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7202 字 阅读 →
论文解读

TabPFN beyond Tabular Data: Calibration and Accuracy on Multimodal Embeddings

音频分类 | 7.9/10

 · 更新于 2026-09-24 · 约 20 分钟 · 9587 字 阅读 →
论文解读

Which Languages Transfer Best to Warlpiri? A Similarity-Based Study for Low-Resource ASR

语音识别 | 6.5/10

 · 更新于 2026-09-24 · 约 14 分钟 · 6688 字 阅读 →
论文解读

From Sinhala to Dhivehi: Cross-Lingual Transfer Learning for Low-Resource Speech Recognition

语音识别 | 6.6/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7890 字 阅读 →