基于LSTM神经网络的声纹识别 Voiceprint Recognition Based on LSTM Neural Network期刊界 All Journals 搜尽天下杂志传播学术成果专业期刊搜索期刊信息化学术搜索

基于LSTM神经网络的声纹识别

引用本文：	刘晓璇,季怡,刘纯平.基于LSTM神经网络的声纹识别[J].计算机科学,2021,48(z2):270-274.

作者姓名：	刘晓璇季怡刘纯平

作者单位：	苏州大学计算机科学与技术学院江苏苏州 215006

摘要：	声纹识别利用说话人生物特征的个体差异性,通过声音来识别说话人的身份.声纹具有非接触、易采集、特征稳定等特点,应用领域十分广泛.现有的统计模型方法具有提取特征单一、泛化能力不强等局限性.近年来,随着人工智能深度学习的快速发展,神经网络模型在声纹识别领域崭露头角.文中提出基于长短时记忆(Long Short-Term Memory,LSTM)神经网络的声纹识别方法,使用语谱图提取声纹特征作为模型输入,从而实现文本无关的声纹识别.语谱图能够综合表征语音信号在时间方向上的频率和能量信息,表达的声纹特征更加丰富.LSTM神经网络擅长捕捉时序特征,着重考虑了时间维度上的信息,相比其他神经网络模型,更契合语音数据的特点.文中将LSTM神经网络长期学习的优势与声纹语谱图的时序特征有效结合,实验结果表明,在THCHS-30语音数据集上取得了84.31％的识别正确率.在自然环境下,对于3 s的短语音,该方法的识别正确率达96.67％,与现有的高斯混合模型和卷积神经网络方法相比,所提方法的识别性能更优.
关键词：	声纹识别长短时记忆语谱图神经网络深度学习
Voiceprint Recognition Based on LSTM Neural Network

LIU Xiao-xuan,JI Yi,LIU Chun-ping.Voiceprint Recognition Based on LSTM Neural Network[J].Computer Science,2021,48(z2):270-274.

Authors:	LIU Xiao-xuan JI Yi LIU Chun-ping

Abstract:

Keywords:
本文献已被万方数据等数据库收录！

设为首页 | 免责声明 | 关于勤云 | 加入收藏