基于深度学习的端到端乐谱音符识别

黄志清; 贾翔; 郭一帆; 张菁

首页> 中文期刊> 《天津大学学报：自然科学与工程技术版》 >基于深度学习的端到端乐谱音符识别

基于深度学习的端到端乐谱音符识别

开具论文收录证明 >>

期刊封面封底目录下载 >>

文献代查 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

光学乐谱识别是音乐信息检索中一项重要技术,音符识别是乐谱识别及其关键的部分.针对目前乐谱图像音符识别精度低、步骤冗杂等问题,设计了基于深度学习的端到端音符识别模型.该模型利用深度卷积神经网络,以整张乐谱图像为输入,直接输出音符的时值和音高.在数据预处理上,通过解析Music XML文件获得模型训练所需的乐谱图像和对应的标签数据,标签数据是由音符音高、音符时值和音符坐标组成的向量,因此模型通过训练来学习标签向量将音符识别任务转化为检测、分类任务.之后添加噪声、随机裁剪等数据增强方法来增加数据的多样性,使得训练出的模型更加鲁棒;在模型设计上,基于darknet53基础网络和特征融合技术,设计端到端的目标检测模型来识别音符.用深度神经网络darknet53提取乐谱图像特征图,让该特征图上的音符有足够大的感受野,之后将神经网络上层特征图和该特征图进行拼接,完成特征融合使得音符有更明显的特征纹理,从而让模型能够检测到音符这类小物体.该模型采用多任务学习,同时学习音高、时值的分类任务和音符坐标的回归任务,提高了模型的泛化能力.最后在Muse Score生成的测试集上对该模型进行测试,音符识别精度高,可以达到0.96的时值准确率和0.98的音高准确率.

著录项

来源
《天津大学学报：自然科学与工程技术版》 |2020年第6期|653-660|共8页
作者
黄志清; 贾翔; 郭一帆; 张菁;
展开▼
作者单位

北京工业大学信息学部;

北京100022;

展开▼
原文格式 PDF
正文语种 chi
中图分类人工智能理论;
关键词
光学乐谱识别; 音符识别; 深度学习; 端到端; 目标检测;

相似文献

中文文献
外文文献
专利

1. 基于深度学习的端到端车牌检测识别系统 [J] . 曹正凤 ,李少丁 ,王栋梁 . 中国交通信息化 . 2018,第009期
2. 基于深度学习的端到端车牌检测识别系统 [J] . 曹正凤 ,李少丁 ,王栋梁 . 中国交通信息化 . 2018,第009期
3. 基于深度学习的端到端验证码识别 [J] . 温明莉 ,赵轩 ,蔡梦倩 . 无线互联科技 . 2017,第014期
4. 基于深度学习的移动端交通标志识别研究与实现 [J] . 杨鑫 . 通信与信息技术 . 2021,第004期
5. 基于深度学习的移动端语音识别系统设计 [J] . 谭磊 ,余欣洋 ,罗伟洋 . 单片机与嵌入式系统应用 . 2020,第009期
6. 基于深度学习的移动端人脸识别技术 [C] . 郭永红 ,李胜昌 ,赵东阳 . 全国抗恶劣环境计算机第二十七届学术年会 . 2017
7. 基于深度学习的自然场景文本检测及端到端识别的研究 [A] . 刘禹良 . 2020

基于深度学习的端到端乐谱音符识别

摘要

著录项

相似文献

相关主题

期刊订阅