EM-KalmanNet: Learned Expectation-Maximization for Adaptive Tracking in Partially Known, Block-Wise Time-Varying State-Space Models

📄 EM-KalmanNet: Learned Expectation-Maximization for Adaptive Tracking in Partially Known, Block-Wise Time-Varying State-Space Models 标签:#声源定位 #RNN #测试时自适应 #高效推理 #鲁棒性 8.8/10 | 创新 1.6/2 | 严谨 1.3/1.5 | 实验 1.2/1.5 | 清晰 0.9/1 | 影响 1.2/1.5 | 开源 1.2/1.5 | 复现 0.4/0.5 | 工程 1/1.5 🔥 8.8/10 | 前25% | 文档类型:方法研究 | 评分置信度:高 | #声源定位 | #RNN | #测试时自适应 #高效推理 | arxiv 👥 作者与机构 第一作者:Ori Cohen(School of ECE, Ben-Gurion University of the Negev, Israel) 通讯作者:正文未明确标注通讯作者 作者列表:Ori Cohen、Nir Shlezinger、Tirza Routtenberg(机构:School of ECE, Ben-Gurion University of the Negev, Israel) ...

2026-08-26 · 更新于 2026-09-04 · 4 min · 790 words

A Computationally Efficient Likelihood Approximation for Target Tracking in Time-Varying Multipath Channels

📄 A Computationally Efficient Likelihood Approximation for Target Tracking in Time-Varying Multipath Channels 标签:#声源定位 #生成模型 #理论分析 #高效推理 9.8/10 | 创新 1.7/2 | 严谨 1.4/1.5 | 实验 1.4/1.5 | 清晰 0.8/1 | 影响 1.3/1.5 | 开源 1.5/1.5 | 复现 0.4/0.5 | 工程 1.3/1.5 🔥 9.8/10 | 前10% | 文档类型:方法研究 | 评分置信度:中 | #声源定位 | #生成模型 | #理论分析 #高效推理 | arxiv 👥 作者与机构 第一作者:Ashwani Koul(Linköping University, Linköping, Sweden) 通讯作者:正文未明确标注 作者列表:Ashwani Koul、Gustaf Hendeby、Isaac Skog(机构:Linköping University;KTH;FOI-Swedish Defence Research Agency, Sweden) ...

2026-08-25 · 更新于 2026-09-04 · 2 min · 400 words

A Regularized Block Diagonal RLS Algorithm for Acoustic Echo Cancellation

📄 A Regularized Block Diagonal RLS Algorithm for Acoustic Echo Cancellation 标签:#回声消除 #模型压缩 #高效推理 #实时处理 #理论分析 7.2/10 | 创新 1.5/2 | 严谨 1.3/1.5 | 实验 1.3/1.5 | 清晰 0.8/1 | 影响 1/1.5 | 开源 0/1.5 | 复现 0.4/0.5 | 工程 0.9/1.5 ✅ 7.2/10 | 前50% | 文档类型:方法研究 | 评分置信度:中 | #回声消除 | #模型压缩 | #高效推理 #实时处理 | arxiv 👥 作者与机构 第一作者:Ruibin Hou(The College of Computer Science and Technology, Inner Mongolia Minzu University, Tongliao, 028000, Inner Mongolia, China) 通讯作者:正文未明确标注 作者列表:Ruibin Hou、Chenggang Zhang、Yufeng Diao(机构:The College of Computer Science and Technology, Inner Mongolia Minzu University, Tongliao, 028000, Inner Mongolia, China) ...

2026-08-25 · 更新于 2026-09-04 · 3 min · 635 words

PolyChirp: Multi-Species Birdsong Classification Using TinyML on Low-Power Acoustic Sensors

📄 PolyChirp: Multi-Species Birdsong Classification Using TinyML on Low-Power Acoustic Sensors 标签:#音频分类 #CNN #模型压缩 #高效推理 10.0/10 | 创新 1.6/2 | 严谨 1.4/1.5 | 实验 1.5/1.5 | 清晰 1/1 | 影响 1.3/1.5 | 开源 1.5/1.5 | 复现 0.4/0.5 | 工程 1.3/1.5 🔥 10.0/10 | 前10% | 文档类型:系统技术报告 | 评分置信度:中 | #音频分类 | #CNN | #模型压缩 #高效推理 | arxiv 👥 作者与机构 第一作者:Nathan Duboisset(École Polytechnique, Palaiseau, France;Freie Universität Berlin, Berlin, Germany) 通讯作者:正文未明确标注 作者列表:Nathan Duboisset、Zhaolan Huang、Felix Bießmann、Roudy Dagher、Antoine Lavandier、Emmanuel Baccelli(机构:École Polytechnique;Freie Universität Berlin;Berlin University of Applied Sciences (BHT);HES-SO Valais-Wallis;Inria) ...

2026-08-25 · 更新于 2026-09-04 · 3 min · 561 words

Pre-Decoding Acoustic Triage for Budgeted Vision-Language Captioning of Untrimmed Egocentric Video

📄 Pre-Decoding Acoustic Triage for Budgeted Vision-Language Captioning of Untrimmed Egocentric Video 标签:#音视频理解 #CNN #多模态模型 #高效推理 9.0/10 | 创新 1.8/2 | 严谨 1.4/1.5 | 实验 1.4/1.5 | 清晰 0.9/1 | 影响 1.3/1.5 | 开源 0.5/1.5 | 复现 0.4/0.5 | 工程 1.3/1.5 🔥 9.0/10 | 前10% | 文档类型:方法研究 | 评分置信度:中 | #音视频理解 | #CNN | #多模态模型 #高效推理 | arxiv 👥 作者与机构 第一作者:Masoud Jalayer(Aalto University,芬兰) 通讯作者:正文未明确标注 作者列表:Masoud Jalayer、Changyi Li、Yu Xiao(机构:Aalto University,芬兰(Dept. of Information Communications Engineering;Dept. of Electrical Engineering and Automation)) ...

2026-08-25 · 更新于 2026-09-04 · 3 min · 478 words

SlimDiffuSE: Towards Efficient Diffusion-Based Speech Enhancement using Slimmable Networks

📄 SlimDiffuSE: Towards Efficient Diffusion-Based Speech Enhancement using Slimmable Networks 标签:#语音增强 #扩散模型 #模型压缩 #高效推理 7.6/10 | 创新 1.7/2 | 严谨 1.3/1.5 | 实验 1.4/1.5 | 清晰 0.8/1 | 影响 1.2/1.5 | 开源 0/1.5 | 复现 0.4/0.5 | 工程 0.8/1.5 ✅ 7.6/10 | 前25% | 文档类型:方法研究 | 评分置信度:中 | #语音增强 | #扩散模型 | #模型压缩 #高效推理 | arxiv 👥 作者与机构 第一作者:Nagashree K. S. Rao(Fraunhofer IIS, Am Wolfsmantel 33, 91058 Erlangen, Germany) 通讯作者:正文未明确标注 作者列表:Nagashree K. S. Rao、Shrishti Saha Shetu、Mohamed Elminshawi、Emanuël A. P. Habets、Andreas Brendel(机构:Fraunhofer IIS, Am Wolfsmantel 33, 91058 Erlangen, Germany;International Audio Laboratories Erlangen) ...

2026-08-25 · 更新于 2026-09-04 · 3 min · 470 words

Spiking Neural Networks for Energy-Efficient Object Detection in Forward-Looking Sonar Imagery

📄 Spiking Neural Networks for Energy-Efficient Object Detection in Forward-Looking Sonar Imagery 标签:#音频事件检测 #CNN #高效推理 #鲁棒性 8.5/10 | 创新 1.6/2 | 严谨 1.3/1.5 | 实验 1.3/1.5 | 清晰 0.9/1 | 影响 1.3/1.5 | 开源 0.5/1.5 | 复现 0.4/0.5 | 工程 1.2/1.5 🔥 8.5/10 | 前25% | 文档类型:应用研究 | 评分置信度:中 | #音频事件检测 | #CNN | #高效推理 #鲁棒性 | arxiv 👥 作者与机构 第一作者:Gwenevere Frank(Department of Electrical Engineering, University of California San Diego, La Jolla, CA 92093, USA) 通讯作者:正文未明确标注 作者列表:Gwenevere Frank、Gert Cauwenberghs(机构:Department of Electrical Engineering 与 Department of Bioengineering, University of California San Diego, La Jolla, CA 92093, USA) ...

2026-08-25 · 更新于 2026-09-04 · 3 min · 522 words

TurboBias 2.0: Streaming Context-Biasing for Production-Efficient ASR Systems

📄 TurboBias 2.0: Streaming Context-Biasing for Production-Efficient ASR Systems 标签:#语音识别 #模型融合 #流式处理 #实时处理 #高效推理 9.0/10 | 创新 1.6/2 | 严谨 1.3/1.5 | 实验 1.4/1.5 | 清晰 0.8/1 | 影响 1.2/1.5 | 开源 1.2/1.5 | 复现 0.4/0.5 | 工程 1.1/1.5 🔥 9.0/10 | 前10% | 文档类型:系统技术报告 | 评分置信度:中 | #语音识别 | #模型融合 | #流式处理 #实时处理 | arxiv 👥 作者与机构 第一作者:Vladimir Bataev(NVIDIA, Yerevan, Armenia) 通讯作者:Vladimir Bataev 作者列表:Vladimir Bataev、Lilit Grigoryan、Andrei Andrusenko、Nikolay Karpov、Vitaly Lavrukhin、Boris Ginsburg(机构:NVIDIA, Yerevan, Armenia;NVIDIA, Santa Clara, USA) ...

2026-08-25 · 更新于 2026-09-04 · 4 min · 711 words

WnW: Waxing-and-Waning KV Cache for Long-Form Speech LLMs

📄 WnW: Waxing-and-Waning KV Cache for Long-Form Speech LLMs 标签:#语音交互 #语音大模型 #高效推理 #长音频处理 9.4/10 | 创新 1.9/2 | 严谨 1.5/1.5 | 实验 1.4/1.5 | 清晰 0.9/1 | 影响 1.4/1.5 | 开源 0.5/1.5 | 复现 0.4/0.5 | 工程 1.4/1.5 🔥 9.4/10 | 前10% | 文档类型:方法研究 | 评分置信度:中 | #语音交互 | #语音大模型 | #高效推理 #长音频处理 | arxiv 👥 作者与机构 第一作者:Yiming Yao(Xiamen University,School of Informatics;闽台非物质文化遗产数字化保护与智能处理重点实验室) 通讯作者:Jinsong Su 作者列表:Yiming Yao、Chenyang Lyu、Xuanfan Ni、Longyue Wang、Weihua Luo、Yazheng Yang、Jinsong Su(机构:Alibaba Group;Xiamen University,School of Informatics;闽台非物质文化遗产数字化保护与智能处理重点实验室) ...

2026-08-25 · 更新于 2026-09-04 · 4 min · 721 words

A Resource-Efficient CNN-Based EEG Auditory Attention Decoding ASIC

📄 A Resource-Efficient CNN-Based EEG Auditory Attention Decoding ASIC 标签:#助听器 #CNN #实时处理 #高效推理 6.2/10 | 创新 1/2 | 严谨 1.2/1.5 | 实验 0.9/1.5 | 清晰 0.8/1 | 影响 0.9/1.5 | 开源 0/1.5 | 复现 0.1/0.5 | 工程 1.3/1.5 ✅ 6.2/10 | 前50% | 文档类型:系统技术报告 | 评分置信度:中 | #助听器 | #CNN | #实时处理 #高效推理 | arxiv 👥 作者与机构 Qier Ma、Richard George、Stefan Scholze、Christian Mayr 来自德累斯顿工业大学(Technische Universität Dresden)电气工程与信息技术系高并行 VLSI 系统与神经微电子讲席;Jehn Constantin 与 Tobias Reichenbach 来自埃尔朗根-纽伦堡弗里德里希·亚历山大大学(FAU)生物医学工程人工智能系。项目获德国联邦研究、技术与航天部 Cluster4Future SEMECO 项目(03ZU1210FA)资助,论文带有 IEEE 版权声明。 ...

2026-08-21 · 更新于 2026-09-04 · 2 min · 414 words