![](https://img-blog.csdnimg.cn/20201014180756926.png?x-oss-process=image/resize,m_fixed,h_64,w_64)
语音识别
MagicBubble
follow excellence,success will chase you!
展开
-
ASR中常用的语音特征之FBank和MFCC(原理 + Python实现)
一步一步讲解和实现ASR中常用的语音特征——FBank和MFCC的提取,包括算法原理、代码和可视化等。完整Jupyter Notebook链接:https://github.com/Magic-Bubble/SpeechProcessForMachineLearning/blob/master/speech_process.ipynb原创 2019-05-17 16:30:50 · 24851 阅读 · 12 评论 -
基于GMMs-HMMs的语音识别原理
刚入门ASR的时候一直能听到HMM模型的相关字眼,这里就补一下用GMMs-HMMs进行语音识别的原理,虽然这个方法很古老,而且已经近乎被神经网络所取代,但它背后的思想仍然值得我们去了解和学习~笔者看了一些教程,包括课程讲义、博客还有一些工具书,总算大致理清了思路,相信至少在文章逻辑上比一些没有相关背景设定、无厘头、不知所云的教程要好,原理上至少也是能用到的都有介绍。而有些地方太深入的原理笔者也没有去细究,感兴趣的读者根据笔者的逻辑自己去深入探索即可。整体的行文思路按照“结果导向”,需要什么数学知原创 2019-05-29 11:16:45 · 1717 阅读 · 3 评论 -
基于DNN-HMMs的语音识别原理
在上一篇博客基于GMMs-HMMs的语音识别原理中,介绍了第一代较为成熟的GMMs-HMMs语音识别模型。但随着神经网络技术的发展,后面又出现了基于DNN-HMMs的语音识别模型,一句话概括就是用DNN代替之前的GMMs,有更好的建模能力。这篇博客将详细介绍它的原理。原创 2019-06-02 20:05:59 · 4261 阅读 · 1 评论