计算机应用研究2021,Vol.38Issue(12) :3569-3573.DOI:10.19734/j.issn.1001-3695.2021.05.0184

基于多分辨率特征和时频注意力的环境声音分类

Environmental sound classification based on multi-resolution features and time-frequency attention

刘慧 李小霞 何宏森
计算机应用研究2021,Vol.38Issue(12) :3569-3573.DOI:10.19734/j.issn.1001-3695.2021.05.0184

基于多分辨率特征和时频注意力的环境声音分类

Environmental sound classification based on multi-resolution features and time-frequency attention

刘慧 1李小霞 2何宏森2
扫码查看

作者信息

  • 1. 西南科技大学 信息工程学院,四川 绵阳621010
  • 2. 西南科技大学 信息工程学院,四川 绵阳621010;西南科技大学 特殊环境机器人技术四川省重点实验室,四川 绵阳621010
  • 折叠

摘要

针对环境声音分类(ESC),提出了一种基于多分辨率特征和时频注意力的卷积神经网络环境声音分类方法.首先,相较单一分辨率的谱图,多通道多分辨率特征可以丰富特征信息,实现不同特征分辨率之间信息互补,增强特征的表达能力;其次,针对声信号提出了一种时频注意力模块,该模块先利用不同大小的一维卷积分别关注时域和频域有效信息,再用二维卷积将两者进行融合,从而抑制环境声中背景噪声并消除由多通道多分辨率带来的冗余信息干扰.实验结果表明,在ESC-10和ESC-50两个基准数据集上的分类准确率达到了98.50%和88.46%,与现有的最新方法相比分别提高了2.70%和0.76%.

关键词

环境声音分类/卷积神经网络/时频注意力/多通道特征/多分辨率特征

引用本文复制引用

基金项目

国家自然科学基金(62071399)

出版年

2021
计算机应用研究
四川省电子计算机应用研究中心

计算机应用研究

CSTPCDCSCD北大核心
影响因子:0.93
ISSN:1001-3695
被引量3
参考文献量2
段落导航相关论文