Self-Calibration DOA Estimation for Movable Antenna Systems with Antenna Position Errors
声源定位 | 4/10
声源定位 | 4/10
统一音频模型 | 8.3/10
语音质量评估 | 10/10
语音质量评估 | 7.7/10
共分析 19 篇语音/AI 论文
A Semantically Consistent Dataset for Data-Efficient Query-Based Universal Sound Separation
** | 8.0/10
Acoustic Interference: A New Paradigm Weaponizing Acoustic Latent Semantic for Universal Jailbreak against Large Audio Language Models
ADEPT: RL-Aligned Agentic Decoding of Emotion via Evidence Probing Tools — From Consensus Learning to Ambiguity-Driven Emotion Reasoning
AG-REPA: Causal Layer Selection for Representation Alignment in Audio Flow Matching
AgentSteerTTS: A Multi-Agent Closed-Loop Framework for Composite-Instruction Text-to-Speech
Alethia: a Foundational Encoder for Voice Deepfakes
Any-Diffusion: Unified Multimodal Understanding and Generation with Masked Discrete Diffusion
Ariadne's Thread of LipSync: Unraveling Forgeries via Inconsistency between Lip Motions and Head Poses
AudioChat: Unified Audio Storytelling, Editing, and Understanding with Transfusion Forcing
AudioMosaic: Contrastive Masked Audio Representation Learning
AuTAgent: A Reinforcement Learning Framework for Tool-Augmented Audio Reasoning
AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation
AVI-Bench: Toward Human-like Audio-Visual Intelligence of Omni-MLLMs
AVTrack: Audio-Visual Speaker Tracking in Complex Scenes