-
题名一种基于三维卷积的声学事件联合估计方法
- 1
-
-
作者
梅鹏程
杨吉斌
张强
黄翔
-
机构
陆军工程大学指挥控制工程学院
-
出处
《计算机科学》
CSCD
北大核心
2023年第3期191-198,共8页
-
基金
国家自然科学基金(62071484)。
-
文摘
声学事件定位与检测在监控、异常检测等任务中应用广泛,以基于卷积递归神经网络架构为代表的深度学习方法可以联合实现声学事件检测和声源定位。为提高定位与检测的综合性能,提出了一种基于三维卷积的声学事件联合估计方法SELD3Dnet。通过对输入的多通道音频计算幅度相位特征,并经过多重三维卷积结构提取高层特征表示,最后利用循环网络和全连接层实现声音事件类别和空间位置的估计。在处理多通道的声学信号特征时,三维卷积可以同时对时间、频率、信号通道3个维度进行卷积计算,最大程度地利用信号通道间的相关性,克服噪声和混响的影响。在TUT2018和TAU2019等公开数据集上进行了充分的对比实验。结果表明,所提方法在TUT2018 REAL和TUT2019 MREAL数据集上的综合性能都有显著提升。其中,在TUT2018 REAL数据集上声学事件检测的F1指标显著提升了13.9%,帧准确率显著提升了21.1%;在TUT2019 MREAL数据集上F1指标显著提升了10.8%,帧准确率显著提升了14.4%。表明所提方法能有效克服实际信号中混响的影响。
-
关键词
声学事件定位与检测
深度学习
卷积神经网络
三维卷积
多通道信号
-
Keywords
Sound event localization and detection
Deep Learning
Convolutional neural networks
Three-dimension convolution
Multi-channel signal
-
分类号
TP391.42
[自动化与计算机技术—计算机应用技术]
TN912.16
[电子电信—通信与信息系统]
-