论文解读
SALSA: Speech Aware LLM Adaptation via Learned Steering Activation Vectors
语音识别 | 7.2/10
语音识别 | 7.2/10
语音识别 | 5.3/10
语音编辑 | 8.7/10
语音识别 | 7.5/10
语音合成 | 9.6/10
语音合成 | 7.6/10
语音合成 | 8.9/10
语音识别 | 8/10
音频分类 | 7.1/10
共分析 35 篇语音/AI 论文
音频质量评估 | 6.5/10
语音识别 | 5.5/10
音乐生成 | 8.6/10
针对语音/音乐/环境声的神经音频水印,DiffErase 在不查询检测器且不知水印方案的黑盒条件下,通过梅尔频谱的中间噪声扰动与预训练扩散去噪重生实现去除,并在五种水印系统上将检测 TPR 降至近 0 的同时以 t* 控制保真度代价。
语音合成 | 10/10
语音翻译 | 7.8/10
自监督学习 | 9.7/10
口音识别 | 8.3/10
生成对抗网络 | 8.1/10
针对几何变化压制材料特征的问题,GaMi 用共位毫米波与声学的共享几何一致性做对齐-校准-相减解耦,并以样本间对比抑制残差,在 20 类材料上以 95.2% 的总体准确率显著优于单模态基线,代价是需双模态同步采集与多目标联合训练。