基于局部线性嵌入算法的汉语数字语音识别

计算机工程与应用 ›› 2012, Vol. 48 ›› Issue (31): 105-107.

• 数据库、信号与信息处理 • 上一篇下一篇

基于局部线性嵌入算法的汉语数字语音识别

高文曦，于凤芹

江南大学物联网工程学院，江苏无锡 214122

出版日期:2012-11-01 发布日期:2012-10-30

Mandarin digit speech recognition based on locally linear embedding algorithm

GAO Wenxi, YU Fengqin

School of Internet of Things Engineering, Jiangnan University, Wuxi, Jiangsu 214122, China

Online:2012-11-01 Published:2012-10-30

摘要/Abstract

摘要： 语音信号转换到频域后维数较高，流行学习方法可以自主发现高维数据中潜在低维结构的规律性，提出采用流形学习的方法对高维数据降维来进行汉语数字语音识别。采用流形学习中的局部线性嵌入算法提取语音频域上高维数据的低维流形结构特征，再将低维数据输入动态时间规整识别器进行识别。仿真实验结果表明，采用局部线性嵌入算法的汉语数字语音识别相较于常用声学特征MFCC维数要少，识别率提高了1.2%，有效提高了识别速度。

关键词: 汉语数字识别, 流形学习, 局部线性嵌入算法, 动态时间规整

Abstract: Speech signal dimensions are higher when the signal is transformed to frequency domain, manifold learning algorithm can find a smooth low-dimensional manifold embedded in the high-dimensional data space. The manifold learning algorithm is proposed to reduce the dimensions in the high-dimensional data for Mandarin digit speech recognition. Low-dimensional manifold structure is extracted from the high-dimensional frequency data based on locally linear embedding of manifold learning algorithms. Then the resulting low-dimensional data is inputted into Dynamic Time Warping（DTW） to recognize. Simulation results demonstrate that the dimensions are lower using Local Linear Embedding（LLE） compared with MFCC, the recognition rate increases by 1.2% in Mandarin digit speech recognition, and the recognition speed gets improved effectively.

Key words: Mandarin digit recognition, manifold learning algorithm, Locally Linear Embedding（LLE）, Dynamic Time Warping（DTW）

高文曦，于凤芹. 基于局部线性嵌入算法的汉语数字语音识别[J]. 计算机工程与应用, 2012, 48(31): 105-107.

GAO Wenxi, YU Fengqin. Mandarin digit speech recognition based on locally linear embedding algorithm[J]. Computer Engineering and Applications, 2012, 48(31): 105-107.

[1]	徐承志，万方. 两级邻域采样的孪生网络在流形学习中的应用[J]. 计算机工程与应用, 2021, 57(9): 233-239.
[2]	陈明月，刘三阳. 自适应流形学习在故障诊断中的应用[J]. 计算机工程与应用, 2021, 57(3): 247-252.
[3]	邱建荣，罗汉. 改进的局部线性嵌入算法及其应用[J]. 计算机工程与应用, 2020, 56(3): 176-179.
[4]	王见，毛黎明，尹爱军. 结合形状特征及其上下文的多维DTW[J]. 计算机工程与应用, 2020, 56(22): 42-47.
[5]	陈媛，陈晓云. 流形极限学习机自编码特征表示[J]. 计算机工程与应用, 2020, 56(17): 150-155.
[6]	董安国，张倩，刘洪超，梁苗苗. 基于TSNE和多尺度稀疏自编码的高光谱图像分类[J]. 计算机工程与应用, 2019, 55(21): 177-182.
[7]	范纯龙，崔宇斌，滕一平. 基于自适应搜索窗口的序列相似比对算法[J]. 计算机工程与应用, 2019, 55(2): 54-59.
[8]	王浩，夏利民. 基于堆叠深度卷积沙漏网络的步态识别[J]. 计算机工程与应用, 2019, 55(14): 127-133.
[9]	魏迪，刘德山，闫德勤，张悦. 应用于人脸图像识别的邻域保持极限学习机[J]. 计算机工程与应用, 2019, 55(11): 187-191.
[10]	谢小雨1，刘喆颉1，2. 基于DTW算法的肌电信号手势识别方法[J]. 计算机工程与应用, 2018, 54(5): 132-137.
[11]	曹中义，吉根林，谈超. 改进的多流形LLE学习算法[J]. 计算机工程与应用, 2018, 54(24): 156-163.
[12]	蒋伟东，黄睿. 基于流形学习的约束Laplacian分值多标签特征选择[J]. 计算机工程与应用, 2018, 54(19): 147-150.
[13]	汤春明，赵红波，张小玉. 基于流形学习2D-LDLPA的东亚人脸表情识别算法[J]. 计算机工程与应用, 2018, 54(17): 146-150.
[14]	李云红，王珍，张凯兵，章为川，闫亚娣. 基于学习的图像超分辨重建方法综述[J]. 计算机工程与应用, 2018, 54(15): 13-21.
[15]	崔鹏，张雪婷. 基于流形学习的泛化改进的LTSA算法[J]. 计算机工程与应用, 2017, 53(3): 201-204.

基于局部线性嵌入算法的汉语数字语音识别

Mandarin digit speech recognition based on locally linear embedding algorithm

PDF

可视化

摘要/Abstract

引用本文

使用本文

参考文献

相关文章 15

编辑推荐

Metrics