论文解读

Personalized Keyword Spotting for User-Defined Keywords Leveraging Text-Independent Speaker Verification

说话人验证 | 8.6/10

 · 更新于 2026-09-24 · 约 16 分钟 · 7723 字 阅读 →
论文解读

L-Proto: Language-Aware Episodic Prototypical Training for Multilingual Speaker Verification

说话人验证 | 7.1/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5871 字 阅读 →
论文解读

Stabilizing Short Duration Speaker Verification through Neural Re-scoring with Hybrid Enrollment

说话人验证 | 7.9/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5781 字 阅读 →
论文解读

A Lightweight Dual-Factor Acoustic Authentication System via Cascaded GMM-DTW Architecture for Edge Computing

说话人验证 | 6/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6198 字 阅读 →
论文解读

ViP-VL: Vietnamese Self-supervised Speech Pretraining Model with Vector-Quantization Learning

语音识别 | 9.7/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5467 字 阅读 →
论文解读

Assessing the Energy and Carbon Emissions of Neural Speaker Verification Model in Training and Inference

说话人验证 | 7.4/10

 · 更新于 2026-09-24 · 约 12 分钟 · 5733 字 阅读 →
论文解读

On Low-Bit Quantization Errors in Speaker Verification: Diagnostic and Mitigation

说话人验证 | 6.6/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5313 字 阅读 →
论文解读

SpeakerCard-1M: An Evidence-Grounded Speaker Card Corpus for In-the-Wild Speaker Verification

说话人验证 | 7.4/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6193 字 阅读 →
论文解读

Echo: A Joint-Embedding Predictive Architecture for Speaker Diarization and Speech Recognition in a Shared Latent Space

语音识别 | 7/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7107 字 阅读 →
论文解读

Profiling the Voice: Speaker-Specific Phoneme Fingerprinting for Speech Deepfake Detection

语音伪造检测 | 7/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7180 字 阅读 →
论文解读

SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning

说话人验证 | 7/10

 · 更新于 2026-09-24 · 约 18 分钟 · 8893 字 阅读 →
论文解读

Text-Dependent Speaker Verification (TdSV) Challenge 2024: Team Naive System Report

说话人验证 | 5.5/10

 · 更新于 2026-09-24 · 约 20 分钟 · 9548 字 阅读 →
论文解读

Adaptive Regularization for Sparsity Control in Bregman-Based Optimizers

Adaptive Regularization for Sparsity Control in Bregman-Based Optimizers

 · 更新于 2026-09-24 · 约 16 分钟 · 7952 字 阅读 →
论文解读

DiffSDA: Unsupervised Diffusion Sequential Disentanglement Across Modalities

序列解耦 | 8.0/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6401 字 阅读 →
论文解读

LASE: Language-Adversarial Speaker Encoding for Indic Cross-Script Identity Preservation

说话人验证 | 8.5/10

 · 更新于 2026-09-24 · 约 15 分钟 · 7232 字 阅读 →
论文解读

Dual-LoRA: Parameter-Efficient Adversarial Disentanglement for Cross-Lingual Speaker Verification

说话人验证 | 7.0/10

 · 更新于 2026-09-24 · 约 11 分钟 · 5273 字 阅读 →
论文解读

DiffAnon: Diffusion-based Prosody Control for Voice Anonymization

语音匿名化 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4816 字 阅读 →
论文解读

Dual-LoRA: Parameter-Efficient Adversarial Disentanglement for Cross-Lingual Speaker Verification

说话人验证 | 7.5/10

 · 更新于 2026-09-24 · 约 13 分钟 · 6131 字 阅读 →
论文解读

Connecting Layer-Wise Representation of Wavlm with Spectro-Temporal Modulation on Speaker Verification

说话人验证 | 6.0/10

 · 更新于 2026-09-24 · 约 9 分钟 · 4366 字 阅读 →
论文解读

Content Anonymization for Privacy in Long-Form Audio

语音匿名化 | 7.5/10

 · 更新于 2026-09-24 · 约 10 分钟 · 4691 字 阅读 →