论文解读

StreamMark: A Deep Learning-Based Semi-Fragile Audio Watermarking for Proactive Deepfake Detection

音频深度伪造检测 | 8.0/10

 · 更新于 2026-09-16 · 约 10 分钟 · 4723 字 阅读 →
论文解读

Stress Prediction from Temporal Emotion Trajectories in Clinical Patient-Physician Conversations

语音情感识别 | 7.0/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4349 字 阅读 →
论文解读

Structure-Aware Diffusion Schrödinger Bridge

数据集对齐 | 7.7/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4076 字 阅读 →
论文解读

StyHarmo: Efficient Style-Specific Video Generation with Music Synchronization

视频生成 | 6.5/10

 · 更新于 2026-09-16 · 约 11 分钟 · 5066 字 阅读 →
论文解读

Style Attack Disguise: When Fonts Become a Camouflage for Adversarial Intent

对抗样本 | 7.0/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4288 字 阅读 →
论文解读

Style-Disentangled Diffusion for Controllable and Identity-Generalized Speech-Driven Body Motion Generation

语音驱动动作生成 | 7.0/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4058 字 阅读 →
论文解读

StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control

基准测试 | 8.5/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4238 字 阅读 →
论文解读

StylePitcher: Generating Style-Following and Expressive Pitch Curves for Versatile Singing Tasks

歌唱语音合成 | 7.5/10

 · 更新于 2026-09-16 · 约 11 分钟 · 5251 字 阅读 →
论文解读

Subgraph Localization in the Subbands for Partially Spoofed Speech Detection

音频深度伪造检测 | 8.0/10

 · 更新于 2026-09-16 · 约 8 分钟 · 3790 字 阅读 →
论文解读

Subsequence SDTW: Differentiable Alignment with Flexible Boundary Conditions

音乐信息检索 | 8.0/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4127 字 阅读 →
论文解读

Subspace Hybrid Adaptive Filtering for Phonocardiogram Signal Denoising

音频增强 | 7.0/10

 · 更新于 2026-09-16 · 约 8 分钟 · 3758 字 阅读 →
论文解读

Sunac: Source-Aware Unified Neural Audio Codec

音频生成 | 7.5/10

 · 更新于 2026-09-16 · 约 9 分钟 · 4495 字 阅读 →
论文解读

SURE: Synergistic Uncertainty-Aware Reasoning for Multimodal Emotion Recognition in Conversations

语音情感识别 | 7.5/10

 · 更新于 2026-09-16 · 约 10 分钟 · 4997 字 阅读 →
论文解读

SwitchCodec: Adaptive Residual-Expert Sparse Quantization for High-Fidelity Neural Audio Coding

音频生成 | 8.5/10

 · 更新于 2026-09-16 · 约 11 分钟 · 5387 字 阅读 →
论文解读

Symphony Rendering: Midi and Composer-Conditioned Auto Orchestration with Flow-Matching Transformers

音乐生成 | 7.0/10

 · 更新于 2026-09-16 · 约 12 分钟 · 5626 字 阅读 →
论文解读

SymphonyGen: 3D Hierarchical Orchestral Generation with Controllable Harmony Skeleton

音乐生成 | 7.5/10

 · 更新于 2026-09-16 · 约 12 分钟 · 5548 字 阅读 →
论文解读

SynaSpot: A Lightweight, Streaming Multi-modal Framework for Keyword Spotting with Audio-Text Synergy

关键词检测 | 7.5/10

 · 更新于 2026-09-16 · 约 8 分钟 · 3921 字 阅读 →
论文解读

Synchronous Secondary Path Modeling and Kronecker-Factorized Adaptive Algorithm for Multichannel Active Noise Control

主动噪声控制 | 7.0/10

 · 更新于 2026-09-16 · 约 10 分钟 · 4919 字 阅读 →
论文解读

Syncspeech: Efficient and Low-Latency Text-to-Speech Based on Temporal Masked Transformer

语音合成 | 7.5/10

 · 更新于 2026-09-16 · 约 10 分钟 · 4853 字 阅读 →
论文解读

SynParaSpeech: Automated Synthesis of Paralinguistic Datasets for Speech Generation and Understanding

语音合成 | 7.5/10

 · 更新于 2026-09-16 · 约 10 分钟 · 4862 字 阅读 →