返回列表 发布新帖

基于正弦注意力表征网络的环境声音识别

8 0
admin 发表于 2024-12-10 15:47 | 查看全部 阅读模式

文档名:基于正弦注意力表征网络的环境声音识别
将正弦注意力表征网络引入环境声音识别,首先提取梅尔频率倒谱系数(Mel-frequencycepstralcoefficient,MFCC)作为音频识别特征,使用门控循环单元提取MFCC每一帧的特征,根据正弦函数激活每一帧音频得分,并依照每一帧的音频得分为音频重新分配权重,从而将注意力集中在音频重点区域.最后结合全连接层和Softmax分类器对环境声音类别进行判别.实验在公开数据集UrbanSound8K上验证并与其他模型对比,结果表明所提出模型效果最好,在数据集上的识别率高达93.5%.
作者:彭宁 陈爱斌 周国雄 陈文洁 刘晶
作者单位:中南林业科技大学人工智能应用研究所,湖南长沙410004;中南林业科技大学计算机与信息工程学院,湖南长沙410004中南林业科技大学人工智能应用研究所,湖南长沙410004;中南林业科技大学智慧物流技术湖南省重点实验室,湖南长沙410004;中南林业科技大学计算机与信息工程学院,湖南长沙410004
母体文献:CCF第35届中国计算机应用大会论文集
会议名称:CCF第35届中国计算机应用大会  
会议时间:2020年10月16日
会议地点:湖北襄阳
主办单位:中国计算机学会
语种:chi
分类号:
关键词:环境声音识别  正弦注意力表征网络  梅尔频率倒谱系数  门控循环单元
在线出版日期:2022年9月21日
基金项目:
相似文献
相关博文
2024-12-10 15:47 上传
文件大小:
2.74 MB
下载次数:
60
高速下载
【温馨提示】 您好!以下是下载说明,请您仔细阅读:
1、推荐使用360安全浏览器访问本站,选择您所需的PDF文档,点击页面下方“本地下载”按钮。
2、耐心等待两秒钟,系统将自动开始下载,本站文件均为高速下载。
3、下载完成后,请查看您浏览器的下载文件夹,找到对应的PDF文件。
4、使用PDF阅读器打开文档,开始阅读学习。
5、使用过程中遇到问题,请联系QQ客服。

本站提供的所有PDF文档、软件、资料等均为网友上传或网络收集,仅供学习和研究使用,不得用于任何商业用途。
本站尊重知识产权,若本站内容侵犯了您的权益,请及时通知我们,我们将尽快予以删除。
  • 手机访问
    微信扫一扫
  • 联系QQ客服
    QQ扫一扫
2022-2025 新资汇 - 参考资料免费下载网站 最近更新浙ICP备2024084428号
关灯 返回顶部
快速回复 返回顶部 返回列表